多领域推理」共找到 6389 篇相关文章

开源动态8

斯坦福开源复杂推理AI Agent,融合超10种工具

传统AI助手应对复杂任务能力有限,斯坦福开源OctoTools,这一复杂推理AI Agent融合11种工具。它在16项基准测试中准确率高,能应对领域复杂场景,框架含工具卡片、规划器等构件。

AIGC开放社区
算法论文8

不让“猪队友”拖后腿!哈深新作 AgentDropoutV2,专治智能体“传话游戏”翻车现场

智能体系统中,常有agent出错带偏整体。哈工大联合阿里提出AgentDropoutV2,测试时介入,设‘质检员’审核输出,结合失败案例构建‘避坑指南’,在测试中显著提效,泛化性强。

深度学习自然语言处理
开源动态8

18.2K Star!macOS 丝滑跑Linux,一键容器、架构支持,开发效率直接起飞!

介绍轻量级虚拟机管理器 `Lima`,它能在 macOS 上提供类似 WSL2 的体验,专注容器化工作流。支持架构与驱动,有开箱即用的容器化支持等特性,安装和使用简单。

开源先锋
开源动态8

Qwen3-Next:迈向更极致的训练推理性价比

文章发布Qwen3-Next架构及Qwen3-Next-80B-A3B系列模型,通过混合注意力等改进提升训练推理效率。介绍模型结构、性能优势,还说明使用方法,包括在平台部署及处理超长上下文,展望持续优化架构。

通义千问Qwen
算法论文8

工行x上交大发布智能体研究成果,通过群体智能刷新翻译新高度!

2025年智能体系统成大模型研发新高地。工行大数据和人工智能实验室与上海交大人工智能学院推出智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理
算法论文8

ICML 2025 Spotlight | 模态大模型暴露短板?EMMA基准深度揭秘模态推理能力

最新研究推出 EMMA 基准测试,揭示顶尖模态大语言模型在深度视觉与文本融合的复杂模态推理上显著不足。该研究已被 ICML 2025 接收,代码数据开源。实验表明,现有模型与人类专家差距大,视觉推理是核心瓶颈。

机器之心
开源动态8

Qwen3技术报告首次全公开!“混合推理模型”是这样炼成的

本文首次公开Qwen3技术报告,介绍其模型架构、预训练及后训练过程、性能表现等技术细节。Qwen3整合两种模式,引入思考预算机制,降低轻量级模型计算资源,在基准测试领先,语言支持扩展至119种,所有模型开源。

通义千问Qwen
算法论文8

复杂空间推理新SOTA,性能提升55%!中山大学新作SpatialDreamer

中山大学等机构推出SpatialDreamer,模拟人类空间认知过程,构建闭环推理流程,还提出GeoPO解决奖励稀疏问题,构建SpatialDreamer - SFT数据集。实验显示其在基准达SOTA,为AI空间智能发展开辟新路径。

新智元
新闻资讯8

谷歌一篇论文引爆存储芯片崩盘!AI内存需求暴降6倍,推理狂飙8倍

谷歌发布TurboQuant算法,将缓存压到3 - bit,内存占用降为1/6,推理速度提升8倍。该算法冲击存储巨头,引发股价下跌,虽目前未改变采购量,但改写推理成本,且从论文到落地的路在缩短。

新智元
新闻资讯8

谷歌2025年终回顾:Gemini 3领衔,六大领域全线突破

本文回顾谷歌2025年发展,从Gemini 1.5 pro开始有变化,到Gemini 2.5 pro质变。谷歌在模型、产品、创意、科学等六大领域突破,如Gemini 3系列模型表现出色,但Sam Altman仍认为谷歌失败。

AI寒武纪