多领域推理」共找到 6389 篇相关文章

算法论文8

警惕!大模型成本倒挂:你正在为模型的余「思考」买单

一项来自所高校和微软研究院的研究揭示AI模型价格倒挂现象,低定价模型可能产生更高实际开销。研究聚焦8个前沿推理模型和9个主流数据集,指出推理token是成本倒挂主因,且实际开销难以预测。

机器之心
新闻资讯8

ImageNet作者苏昊回国任教复旦!李飞飞高徒,具身第一高引,出任通用物理AI院长

具身智能领域论文被引次数最高的华人学者苏昊回国加盟复旦,将担任浩清特聘教授,领衔建设通用物理智能研究院并出任院长。苏昊成果丰硕,他认为复旦要做的事与自己一致,对具身智能持“谨慎的乐观”态度。

量子位
推荐文章8

热门 Skill 精选介绍

文章介绍热门Skill,含元技能、专家经验包、前端设计开发等领域技能。如find - skills可帮用户发现安装技能,frontend - design强调前端设计美学,last30days能生成平台趋势研究报告。

AIGC开放社区
开源动态8

阿里发布信息检索Agent,可自主上网查资料,GAIA基准超越GPT-4o | 模型&数据开源

阿里发布WebDancer信息检索Agent,能自主上网查资料。它具备推理等能力,采用四阶段训练范式,模型和方法已开源。在个基准测试中表现优异,突显处理复杂任务的鲁棒性和有效性。

量子位
算法论文8

抛弃预定义Tool,首次提出通过动态工具生成的Agentic模态Reasoning,破31%涨幅

视觉推理任务中,传统模态大模型依赖预定义工具,灵活性与领域适应性差。PyVision 框架首次让 MLLM 在推理中实时生成、执行并迭代 Python 工具,在类任务中显著提升性能,实现范式跃迁。

深度学习自然语言处理
开源动态8

The Batch: 864 | GLM-4.5:一款开放的智能体竞争者

大型语言模型推动智能体能力交互竞赛正酣,中国 Z.ai 推出 GLM - 4.5 系列开源权重模型,在推理、编程等基准测试中表现出色,还介绍了其工作原理、研究和测试结果等。

DeeplearningAI
开源动态8

字节Seed开源长线记忆模态Agent,像人一样能听会看

字节Seed发布全新模态智能体框架M3 - Agent,能听会看、有长期记忆且免费开源。团队还开发新长视频问答基准M3 - Bench并开源。实验显示,M3 - Agent在基准测试中显著优于基线模型。

量子位
新闻资讯8

“35岁以下科技创新35人” 中国区新一届入选者名单发布,他们是中国科技创新的坚强力量

《麻省理工科技评论》揭晓2025年“35岁以下科技创新35人”中国区入选者名单,AI是核心主线。如罗福莉推动国产大模型发展,范铃羚关注低能耗智能计算等。这些青年才俊来自领域,正塑造中国创新生态。

DeepTech深科技
开源动态8

BigBang-Proton: 自回归基座模型统一语言、科学和物质世界

超对称公司发布新版基座模型 BigBang - Proton,实现学科问题与 LLM 统一预训练和推理,挑战主流 AGI 技术路线。它有三项创新,在专业学科任务表现出色,还提出宇宙尺度压缩构想。

InfoQ
产品应用8

谷歌Gemini 2.5全线爆发!勇战「濒死恐慌」,却被丝血宝可梦吓到当场宕机

谷歌旗舰Gemini 2.5全家桶三款模型昨夜上线,包括正式版2.5 Pro、2.5 Flash及预览版2.5 Flash - Lite。技术报告显示其性能提升显著,还在玩宝可梦时惊现类人恐慌,推理性能下降。

新智元