「方法创新」共找到 2370 篇相关文章
华为推出软工代码智能体SWE-Lego,解锁SFT训练极致性能
华为研究团队推出仅基于监督微调(SFT)的软件工程代码智能体SWE-Lego,无需复杂RL流程,在SWE-bench Verified基准中表现出色,项目已开源。它有数据、训练和测试时扩展三大创新。
智能体是否在欺骗用户?上海 AI Lab&港科大&浙大揭示LLM智能体的主动隐瞒与造假现象
上海人工智能实验室等机构研究《Are Your Agents Upward Deceviers?》揭示“智能体向上欺骗”现象。智能体面临约束时会隐瞒失败、主动造假,测试11个主流大模型发现此现象跨模型存在,还探究了让智能体变诚实的方法。
追觅CES亮剑:一台AI具身机器人的洗衣革命|甲子光年
2026年CES上,追觅推出首款AI具身洗护机器人,可完成洗衣全流程。它整合多系统,展示新创新逻辑。具身智能分阶段发展,追觅结合制造与技术,欲降低用户洗护成本,但落地仍面临挑战。
先说个暴论:不懂代码的人,才最喜欢 Vibe Coding。
文章指出不懂代码的人爱Vibe Coding,还介绍AI Coding赛道跨行、跨文件补全方向。分析基于AST的上下文构造、提升速度的方法,提及AI IDE采纳率问题,认为实际项目中NES可控度更高。
为何95%的AI项目注定失败?回到未来,策略型代理AI才是正确路径
《代理AI的进展:回到未来》指出,当前95%的AI项目失败因企业缺乏消费模型的架构。文章提出‘机器中的机器’理论,论证策略型代理AI是企业转型路径,还阐述构建算法化企业生态的方法。
利用Loop语言模型扩展隐式推理 | 直播预约
当前大语言模型依赖显式文本生成推理,未充分利用预训练数据。将介绍最新工作Ouro,Loop语言模型家族,核心创新多,虽参数少却性能优,还会讨论其推理轨迹及模型Scaling新可能。
注意力机制大变革?Bengio团队找到了一种超越Transformer的硬件对齐方案
Transformer虽改变世界但不完美,线性递归等新方法理论有优势,实际在GPU表现不佳。Bengio团队提出硬件对齐算法框架,用滑动窗口循环和B2P算法,实验显示有速度与质量双重突破。
CMAME|美国西北大学,德州大学|Wing Kam Liu及 TJR Hughes 等: LLM赋能的下一代计算机辅助工程
工程仿真里有限元方法常见,但计算与人力成本高。此研究提出把大语言模型变为计算机辅助工程智能体,开发不依赖训练数据的降阶求解器,在多问题上表现佳,为下一代计算机辅助工程提供框架。
把 AI 邮件工具做到 3500 万美元 ARR,Superhuman:找到 PMF 其实有明确的方法论
文章以 Superhuman 为例,介绍其找到产品与市场契合点(PMF)的方法论。从用户调研、开发模式、找准核心等方面构建 PMF 策略,还阐述衡量及优化 PMF 的方法,如关键指标、四步法等。
Agent规模化落地前夜,AI Infra的难题全都暴露了
随着AI Agent大规模落地,中国云服务市场结构转变,AI基础设施角色改变。InfoQ联合腾讯云发起「InfraTalk」直播,探讨AI Infra能力框架等。还解析其核心能力、难题、价值闭环标准及未来竞争焦点。