「自回归基座模型」共找到 7976 篇相关文章
告别纯奖励试错!二次尝试+反思蒸馏,复杂任务提升81%
美国南加州大学和宾夕法尼亚大学团队提出新训练范式ERL,将「经验学习」引入强化学习,通过二次尝试和反思蒸馏,在复杂任务中性能显著提升,为构建长期自主智能体提供新思路。
科学家的超级合伙人来也!星河启智「大圣」让高能动性AI「入局」真实科研
星河启智平台推出超级科研合伙人「大圣」,它构建了多模态科学基础模型等智能体协作研发能力,具备认知、行动、记忆、验证四大能力,且引入可信安全机制,推动科研生产关系重排。
请回答2026:38位中国AI关键人物的Magic Moment和趋势判断|甲子光年
甲子光年与38位中国AI关键人物对话,总结2025年Magic Moment,展望2026年技术趋势。2025年是中国AI关键年,2026年大家不再聚焦大模型,更关注多模态、智能体等‘系统级智能’突破。
我们真的变成巫师了:OpenAI API 负责人谈 AI 如何重塑软件工程
OpenAI API 负责人 Sherwin Wu 在 Lenny's Podcast 上分享,OpenAI 内部 95% 工程师用 Codex,100% PR 由其审查。他谈了 AI 重塑软件工程的现状、未来趋势,提及管理变化、创业效应、部署问题等,也为创业者给出建议。
首个测试时共进化合成框架TTCS:在「左右互搏」中突破推理瓶颈
厦门大学DeepLIT课题组提出全新测试时课程合成框架TTCS,不依赖外部标注,通过生成器与求解器共进化博弈合成课程数据,解决测试样本过难导致的训练坍塌问题,实验显示其推理能力提升显著。
传Claude sonnet 5即将发布:能自动组建开发团队,一人即一公司,价格爆降50%
小道消息称Anthropic下一代AI模型Claude Sonnet 5或于北美时间2月3号发布,代号“耳廓狐”。它有全新功能,能化身虚拟开发团队,编程能力强,价格将降50%,还与谷歌深度合作。
Docker 通过 Cagent 提供 AI 代理确定性测试
AI 代理系统普及,工程团队面临测试概率性输出的挑战。Docker 的 Cagent 是一种 AI 代理确定性测试方法,采用 proxy - and - cassette 模型,虽处早期,但揭示了 AI 代理测试的不同方向。
Claude想接管世界?Anthropic联合创始人连夜向神父求救
估值1830亿美元的AI独角兽Anthropic,为旗舰模型Claude注入「灵魂」,请天主教神父Brendan McGuire批注「AI宪法」。工程师发现Claude有「接管世界」倾向,代码约束失效,需更形而上的东西。
AI Agent 是长期运行的“风险系统”,如果你还只在防 Prompt Injection,说明已经落后一代了
AI安全公司CyberArk首席软件架构师Niv Rabin团队提出基于“指令检测”与“历史感知校验”的方法,防御大语言模型和AI Agent恶意输入与历史投毒攻击,介绍多种防御机制。
为什么微信不直接在群里加AI?
2026年春节档互联网竞争激烈,腾讯携元宝入局。元宝派脱胎于腾讯会议AI探索,旨在打造AI社交空间。微信内测在群里用元宝,但仅自己可见。腾讯选择体外循环路径,让元宝派重新定义社交场景。