「模型推理能力」共找到 9447 篇相关文章

算法论文8

告别纯奖励试错!二次尝试+反思蒸馏,复杂任务提升81%

美国南加州大学和宾夕法尼亚大学团队提出新训练范式ERL,将「经验学习」引入强化学习,通过二次尝试和反思蒸馏,在复杂任务中性能显著提升,为构建长期自主智能体提供新思路。

新智元
新闻资讯8

请回答2026:38位中国AI关键人物的Magic Moment和趋势判断|甲子光年

甲子光年与38位中国AI关键人物对话,总结2025年Magic Moment,展望2026年技术趋势。2025年是中国AI关键年,2026年大家不再聚焦大模型,更关注多模态、智能体等‘系统级智能’突破。

甲子光年
新闻资讯7

中美安全公司经营对比及原因分析

国内网络安全上市公司财报多显示亏损,而美国同类公司增长与盈利能力强。分析指出,差距源于市场国际化、产品能力和人的因素。国内市场内卷,产品竞争力弱,部分公司决策和态度存在问题。

AI与安全
产品应用7

别再让语音机器人“答非所问”:AI Force任务型语音对话技术总结

本文围绕企业级任务型语音Agent核心挑战,提出解决“拟人化”与“专业化”问题。介绍三段式语音对话解法、架构演进,还提及‘衍算’推理框架等技术及未来方向,团队来自蚂蚁集团AI force。

阿里云开发者
开源动态7

AI 智能体界的 npm 来了!Vercel 推出 Skills.sh,欲统一智能体指令集

Vercel 发布开源项目 Skills.sh,为 AI 智能体打造“标准动作库”,让其通过命令行执行可复用操作。它是开放生态,开发者能定义、分享指令。项目获广泛关注,社区认为其实用性强。

InfoQ
算法论文8

港大张清鹏 Nature 子刊最新研究:AI 结合血液多组学,提前 15 年预测心血管疾病风险

香港大学张清鹏团队基于UK Biobank数据,开展AI与血液多组学结合的研究。成果显示,引入血液多组学信息,能显著提升心血管疾病长期风险预测能力,为风险研究提供新思路。

AI科技评论
新闻资讯7

传Claude sonnet 5即将发布:能自动组建开发团队,一人即一公司,价格爆降50%

小道消息称Anthropic下一代AI模型Claude Sonnet 5或于北美时间2月3号发布,代号“耳廓狐”。它有全新功能,能化身虚拟开发团队,编程能力强,价格将降50%,还与谷歌深度合作。

AI寒武纪
新闻资讯7

Docker 通过 Cagent 提供 AI 代理确定性测试

AI 代理系统普及,工程团队面临测试概率性输出的挑战。Docker 的 Cagent 是一种 AI 代理确定性测试方法,采用 proxy - and - cassette 模型,虽处早期,但揭示了 AI 代理测试的不同方向。

InfoQ
新闻资讯7

Claude想接管世界?Anthropic联合创始人连夜向神父求救

估值1830亿美元的AI独角兽Anthropic,为旗舰模型Claude注入「灵魂」,请天主教神父Brendan McGuire批注「AI宪法」。工程师发现Claude有「接管世界」倾向,代码约束失效,需更形而上的东西。

新智元
产品应用7

Clawdbot为何大火?

LLM记忆问题是业界难题,Clawdbot采用极简方式破解,用写Markdown实现记忆。其记忆系统优势明显,如极简易用、透明可控等,但也有劣势,像数据扩容能力有限、功能扩展性不足等。

CourseAI