「产品优化」共找到 2744 篇相关文章
智能体自己出现问题自己找!首次提出“自动化失败归因”课题 | ICML2025 Spotlight
LLM Multi - Agent系统失败诊断难,阻碍迭代优化。宾夕法尼亚州立大学等机构研究者首次提出“自动化失败归因”课题,构建Who&When数据集,开发评估多种归因方法,实验揭示当前方法不足。
LeCun有了新证据!大模型思考与人类思考存在本质差别
Yann LeCun参与的研究用信息论揭示大语言模型与人类在‘理解世界’上的本质差异。研究引入新量化框架,分析主流大模型,发现AI与人类在‘理解’上有三大核心差异,对当前AI发展趋势提出挑战。
我在Facebook工作四年的总结与反思
作者分享在Facebook四年工作的总结反思。包括目标规划、工作价值判断、处事态度、技术与产品关系等多方面体会,如明确目标、做有价值工作、少片面结论等。
一周两破18年数学纪录!陶哲轩惊叹:AlphaEvolve带来久违「加速度」
人类数学家与AlphaEvolve携手,一周内两次刷新18年未破的数学纪录。先是AlphaEvolve将和差集的θ下界提升,后人类数学家Gerbicz在其基础上再进一步,展现AI与人类协作在数学研究中的惊人潜力。
刚刚,北大校友Lilian Weng自曝公司首个产品?一篇论文未发,估值却已90亿
OpenAI前安全副总裁Lilian Weng疑似曝光90亿估值新公司Thinking Machines首个产品——手动调参仪表盘,训练中可手动调超参数。OpenAI也有AI硬件野心,设想让ChatGPT成全能硬件助手。
6个Claude Code神作,Anthropic亲选
Claude 官方晒出一批来自普通用户的 Claude Code 「神作」,覆盖实用工具、可视化创意和趣味应用等领域,如人脸涂鸦、医学影像查看器、代码库动态图等。这些项目反映出 Claude Code 正走出传统编程场景。
Anthropic:现在学习FDE,年薪百万!
Anthropic大佬分享FDE岗位价值,指出其非外包,是面向客户的软件工程师。还阐述适合的人才、团队,纠正三大误区,强调客户买的是解决问题的过程,现场沟通能力正升值。
DoorDash 如何打造了一款不完全依赖大型语言模型(LLM)的 AI 购物助手
DoorDash 分享对话式 AI 助手 Ask DoorDash 的架构,它借助 LLM、AI 代理等构建系统。测试显示其提升了结账转化率等指标,还构建自动评估框架改进质量衡量,架构分离协调与业务功能。
Claude Code官宣下一版大升级!你在聊天,后台把活干完了
Claude Code创造者Boris Cherny官宣,下一版子智能体默认在后台跑,可边聊边干活。其半年来不断进化,还让Anthropic工程师产出翻三倍,在Spotify实战效果也佳,改变了工程师角色。
微软 SkillOpt:不动模型权重,只训练那份「技能说明书」
微软研究院 Yifan Yang 等人推出 SkillOpt,思路反直觉,不动模型权重,把「技能文档」当可训练参数。它在 52 个组合中表现最优,技能可迁移,代码已开源,还支持多操作。