长思考能力」共找到 4080 篇相关文章

开源动态8

牛!小米开源「音频语言模型」,超1亿小时预训练时间,音频理解和输出能力是真顶!

小米推出开源音频语言模型MiMo - Audio,有超1亿小时预训练时间。它能理解音频,70亿参数模型在多基准测试达SOTA,音频理解超Gemini - 2.5 - Flash,复杂推理优于GPT - 4o - Audio,还支持多模态任务。

开源AI项目落地
8

对话百度文库:不做大模型能直接做的事,能力积累换来竞争壁垒|AI产品Time

百度文库从文档检索平台转型为一站式AI内容获取和创作平台,付费用户超4000万,AI MAU近亿,智能PPT访问量全球第一。访谈中,负责人分享产品理念、优势及运营经验,如不走大模型能直接做的事,从用户需求出发开发功能等。

量子位
算法论文8

手术刀式去噪突破LLM能力上限,从头预训练模型下游任务平均提高7.2% | 中科院&阿里

中科院计算所与阿里Qwen等团队联合提出RefineX框架,通过程序化编辑任务实现预训练数据精炼。它将专家指导结果蒸馏为删除程序,训练优化模型。用其净化数据训练模型,下游任务平均提高7.2%。

量子位
新闻资讯8

“40% 的智能体项目,将走向终止”!紫光股份董事、新华三集团总裁兼 CEO 于英涛最新演讲全文

5月8日,新华三NAVIGATE 2026峰会召开,于英涛演讲指出,当下AI产业亢奋与焦虑并存。他提出行业三大命题,并介绍新华三全栈产品UniPoD S80000。还提及产业与信仰筑基,分享AI时代的真相与信念。

AI前线
新闻资讯7

AI Agent 是期运行的“风险系统”,如果你还只在防 Prompt Injection,说明已经落后一代了

AI安全公司CyberArk首席软件架构师Niv Rabin团队提出基于“指令检测”与“历史感知校验”的方法,防御大语言模型和AI Agent恶意输入与历史投毒攻击,介绍多种防御机制。

InfoQ
新闻资讯8

OpenAI首席研究员Mark Chen访谈:小扎亲手端汤来公司挖人,气得我们端着汤去了Meta

OpenAI首席研究官Mark Chen在访谈中爆料Meta抢人大战升级成送汤大战,还谈到OpenAI核心研究团队规模、应对Gemini 3策略等。他认为OpenAI本质是研究公司,有信心在预训练和模型性能上超越对手,还提及OpenAI for Science等计划。

量子位
产品应用8

金山与华科发布多模态模型MonkeyOCR v1.5:文档解析能力超越PaddleOCR-VL,复杂表格解析首次突破90%

2025年6月以来多模态文档解析成前沿课题。MonkeyOCR v1.5是全新框架,在OmniDocBench v1.5等基准上全面突破,复杂表格等场景提升9.7%,采用两阶段解析管道和复杂表格处理方案。

量子位
推荐文章7

颠覆传统认知!顶尖架构师眼中,决定职业生涯上限的不是技术能力|独家对话一线架构大佬 Christian Ciceri

在软件开发与AI浪潮融合背景下,架构师面临新挑战。InfoQ采访Apiumhub联合创始人Christian Ciceri,探讨‘可度量、可演化的架构’理念及AI影响,Ciceri强调AI辅助而非替代人,架构需团队共创。

InfoQ
算法论文8

RL 效率无损飙升 3 倍:厦大-Shopee-清华联合首创,将投机解码首次引入 RL,推理能力稳如初!

传统RLVR训练中,rollout阶段耗时成瓶颈。厦大 - Shopee - 清华联合团队提出SPEC - RL,将投机解码引入RL,训练提速2 - 3倍,避免重复生成,与主流算法兼容,在多项基准测试中性能稳定。

深度学习自然语言处理
新闻资讯7

烧钱换能力,老员工经验作废!一线Agent厂商、用户经验亲述:抛弃技术驱动,巨额投入如何不打水漂?

集成 AI Agent 竞赛打响,2024 年中国 AI Agent 软件市场规模破 50 亿。InfoQ 对话来也科技汪冠春和英科医疗陈坤,从不同角度谈产品理念与应用策略,涉及引入时间、定位、推广、架构调整等多方面内容。

InfoQ