「规划与执行」共找到 7040 篇相关文章
重新审视SFT的泛化能力:优化动态、数据与模型能力的条件性分析
上海人工智能实验室等联合研究质疑了‘SFT倾向于记忆,RL实现泛化’观点,指出SFT泛化是条件性现象,受优化动态、训练数据、基模型能力影响,还揭示长思维链SFT会带来安全性能退化。
揭秘与评测 30K+ Star 的 Graphify:企业存量系统 AI 编码的"第二大脑"。
文章揭秘评测 30K+ Star 的 Graphify,它能将分散材料转为结构化知识图谱,助 AI 编程助手理解代码。介绍其使用方法、原理,经测试它能提升综合质量、降低探索成本,不过并非万能解药。
Agent Team 实践与架构设计:在约束下构建可演进的一个人开发团队
作者结合构建的Routa,探讨在Token、流程、工具选择等约束下构建可演进的多Agent系统。介绍了Routa架构、原则,如跨Agent通信、状态外置等,还阐述了各设计要点及示例,强调系统可演进性。
走出 MMLU 的高分幻觉:AI Agent 的「斯坦利时刻」与职场生存法则
文章指出多模态大模型在基准测试分数高,在实际业务流程却像‘职场巨婴’。研究团队构建Trainee - Bench测试顶尖模型,结果显示模型离‘独立上岗’远,凸显提升Agent自主学习性的重要性。
分化、新范式、Agent 与全球 AI 竞赛,中国模型主力选手们的 2026 预测
AGI-Next 2026活动聚集众多国内大模型核心人物,「海外独角兽」总结出40条重要判断。涉及模型分化、新范式(自主学习、原生多模态)、Agent、全球AI竞赛等方面内容,对AI未来发展趋势做出探讨。
腾讯AI战略大升级:组织架构重组与混元世界模型1.5发布
2025年12月17日,腾讯宣布两项重大举措,一是重组AI组织架构,成立新部门并任命首席AI科学家;二是发布混元世界模型1.5,能实时生成可交互3D虚拟世界,应用场景广泛,或引领行业进入‘AI原生’新阶段。
员工吐槽“给 AI 擦屁股”更辛苦?揭秘企业 AI 提效的“悖论”与真拐点
InfoQ《极客有约》X AICon 直播探讨企业 AI 提效实战。嘉宾指出用工程化手段控制模型‘幻觉’、做好数据治理很关键。还讨论了模型使用、数据处理、提效感受、招聘标准、场景选择等问题。
用豆包手机的这两周,我好像卷入了一场新与旧的战争。
作者用豆包手机两周,直播后使用微信任务致微信崩溃,遭阿里系等多家APP封禁,影响使用。互联网本质是入口之争,AI手机助手冲击超级APP利益,作者认为这是入口之争序章,建议短、长期不同对待。
硅基生命的「成年礼」:上海具身智能的入世大考与万亿生态突围
2025年,上海具身智能产业发展迅速。政府通过场景开放、算力平权等举措构建生态。智元、傅利叶等企业成果显著。12月12日GDPS大赛是成果检验,各赛道考验机器人不同能力。
2025AI红利爆发!新智元创始人与5位清华系大咖「探索对话」
11月5日,「新浪新闻・2025探索大会」举办,新智元创始人杨静主持探索对话环节,多位嘉宾围绕「如何掌握科技创新的时代红利」展开交流,探讨释放红利路径,还提及协同创新和出海对放大红利的重要性。