「Agent推理」共找到 4505 篇相关文章
Agent Skill 开发者大赛总决赛圆满落幕,共探智能体技术落地新未来
2026年5月22日,Agent Skill开发者大赛总决赛在上海举办,采用双轨模式,38支队伍参赛,覆盖多元场景。大赛由多社区主办、多单位协办,揭晓企业组、高校组特等奖等,推动智能体技术落地。
RLHF与RLVR全都要,陈丹琦团队最新力作将推理能力拓展到通用智能
普林斯顿大学陈丹琦团队发布学术成果,提出基于模型奖励思维的强化学习(RLMT)方法,弥合专门推理与通用对话能力差距,将链式思维优势扩展到更广泛范围,提升整体对话表现。
谷歌IMO金牌模型可以用了!推理性能秒了o3、Grok 4
谷歌拿下IMO金牌的模型Gemini 2.5 Deep Think已在Gemini App推出,速度更快、实用性更强。该模型仅对Ultra订阅用户开放,月费约1803元。其推理性能超o3、Grok 4,有迭代开发等优势。
腾讯开源智能体新框架:不用训练无需充值,用开源模型实现SOTA Agent
智能体框架是推动智能体生态发展的基础设施,但现有框架存在上手门槛高、依赖闭源模型等问题。腾讯优图实验室开源Youtu - agent框架,无需训练模型、不依赖闭源API,性能领先,有多个核心亮点和典型应用案例。
最新W4A4KV4全量化框架,单卡A100大模型推理速度飙升
计算所王颖研究员团队等联合在ASPLOS 2025上发表并开源COMET框架,通过系统 - 算法协同优化,实现全4比特推理性能突破,在多方面有技术亮点,实测性能碾压现有方案且已开源。
同一天,Cursor、ClaudeCode都把 Agent 的手脚伸进了你的内网
9月2、3日,Cursor和Claude Code分别发布功能,让AI Agent工具执行跑在用户网络而非云上,解决企业代码不出内网痛点。这标志AI编程工具进入to B基础设施之争,不过要关注安全信任问题。
剑桥揭开大模型翻车黑箱!别再怪它不懂推理,是行动出错了
剑桥大学等机构研究指出,大模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了自条件化等影响及模型规模的作用。
无需SFT也不用RL,样本级推理优化神器SLOT来了,准确率轻松+10%
西湖大学MAPLE实验室开发的SLOT方法,无需SFT和RL,让模型推理时“临时学习”具体问题。它简单易实现,计算开销小,能使模型准确率大幅提升,还无需额外资源,在各规模模型上效果显著。
170次搜索+50次反思:用GLM-4.7盘点2025 Agent行业趋势,结果太震撼!
作者给智谱新开源的GLM - 4.7布置调研2025年Agent赛道企业的任务,结果令人震撼。该模型进化显著,能整理详细企业信息,还能生成高审美PPT。国内有不少特色AI落地企业。
六个Agent 项目,五个半停留在试点:企业AI 落地到底卡在哪?
这篇文章围绕企业级 AI 落地困境展开,讲述一家制造企业六个 AI Agent 项目多数停留在试点的现象。介绍了「2026 奇点智能产品大会」上,白鸦、张帆等嘉宾从不同角度探讨企业 AI 从‘能用’到‘好用’、从‘辅助’到‘决策’的方法。