多智能体推理能力」共找到 7006 篇相关文章

算法论文8

从单领域到多能力协同:数据混合如何重塑AI的强化学习

上海AI Lab的OpenDataLab团队通过大规模实验剖析可验证强化学习(RLVR)在多领域推理中的机制,发现逻辑与数学数据相互支持、代码推理有跨领域混合效应等,为构建AI推理模型提供关键发现。

深度学习自然语言处理
新闻资讯8

人类已成少数派!DeepMind 研究科学家:广告没人看了,互联网上AI的流量已经超过了真人

Google DeepMind高级研究科学家Nenad Tomašev预测,未来世界主要网民将是智能体。他指出智能体虽能自动化工作,但存在安全风险,如认知单一化、网络陷阱等,还探讨了协作模式、安全防护及未来形态。

AI科技大本营
产品应用8

Claude Opus 4.7炸场,6美元造《我的世界》,临门AGI前强调安全,打工人却更慌了

Anthropic 发布‘目前最强 Opus 模型’Claude Opus 4.7,能力跃升,在多榜单夺冠。写代码、看图表等能力提升,也有网页搜索等能力下降。还展现出游戏开发实力,同步上线Claude Code新功能,加强安全防护。

鲸选AI
新闻资讯7

【独家】对话汤元科技任冬淳:物理AI的瓶颈,在于训练体系|甲子光年

对话汤元科技任冬淳,探讨物理AI瓶颈。他认为物理AI瓶颈在训练体系,要满足数据结构质量、训练验证闭环、数据规模效率三要求。汤元构建训练底座,为具身智能和智驾提供服务,具身智能是未来重心。

甲子光年
算法论文8

综述 | 从“说出来”到“脑中算”:Latent Reasoning的范式跃迁与无限可能

大型语言模型用显式思维链推理有局限,潜在思维链(Latent CoT)让推理在连续隐藏状态空间进行。论文梳理该领域,建立框架,介绍方法,探讨可解释性与无限深度推理,指出价值、挑战与未来方向。

深度学习自然语言处理
新闻资讯7

让GPT-4.1「头皮发麻的考试」!OpenAI给大模型上强度,AI能赢吗?

OpenAI 公布 MRCR 评测标准数据集,其针对 AI 模型上下文能力进行「奥运会」级别测评。MRCR 提升了测试难度,能揭示 AI 能力边界,推动模型发展,帮助更合理应用技术。GPT4.1 在一些测试中表现出色,未来 AI 能力上限充满可能。

新智元
产品应用8

豆包 Seed 2.0 来了:字节模型跨越鸿沟

春节前字节发布豆包大模型 2.0,其在 Text 领域进入榜单前十,视觉能力全球第四且成本低。它定位多模态 Agent 模型,有多种能力升级,文中用多个案例展示其强大,还强调字节重原生能力非简单蒸馏。

MacTalk
产品应用8

Tabbit浏览器实测:AI终于学会帮我上网干活了

本文实测Tabbit浏览器,它刚正式发布且免费。与Arc、Atlas不同,Tabbit切换成本几乎为零,有智能标签整理、妙招功能、Agent智能代理等,还内置多个国内外大模型,但脚本妙招和智能标签整理有改进空间。

花叔
开源动态7

DeepSeek V3.1 把 R1 融了,一堆新活:<think>开关、动态搜索、新ToolCall ...

DeepSeek在Hugging Face悄悄发布V3.1版本,将对话和推理模型合并为混合推理模型。它有显式推理、内置搜索、简化工具调用等特性,Aider测试成绩佳且成本低,但也存在战术回避、幻觉率升高等问题。

探索AGI
开源动态8

Meta联手UCSD发布DeepConf:计算成本暴降85%,99.9%准确率!

Meta AI联合UCSD推出DeepConf技术,解决了AI高难度推理准确率与计算成本的难题。它让AI学会“察言观色”,筛选靠谱推理路径,在AIME 2025竞赛中与GPT - OSS - 120B模型取得99.9%准确率,还节省大量计算资源。

AIGC开放社区