推理能力提升」共找到 6112 篇相关文章

算法论文8

西交大提出QQWorld:仅需10行代码,世界模型成功率提升5.33个百分点

2026 年 3 月 Yann LeCun 等人提出 LeWorldModel,西安交通大学研究团队发现其存在问题,进而提出 QQWorld,用分位数—分位数匹配替换原有的 EP 正则,提升了规划成功率,还提出 Cross - Batch QQ 解决显存问题。

机器之心
推荐文章7

99%的人只发挥出了龙虾的1%的能力:龙虾邪修养法

博主Alex Finn分享让OpenClaw效能提升100倍的核心方法论,即构建专属任务控制中心。介绍了任务看板、日历面板等核心工具模块,还指出不要盲目抄袭,要用反向提示词定制工具面板。

AI寒武纪
算法论文8

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

上海人工智能实验室团队提出的Self-Harness引发关注,它针对Agent外层Harness改进。实验显示,在Terminal-Bench-2.0上,不换模型只改Harness,Qwen3.5-35B-A3B等模型效果显著提升

量子位
新闻资讯7

The Batch:836 | 基准测试成本攀升

独立AI测试实验室披露评估推理模型成本上升。这些模型生成“思维链”提升输出质量,但计算需求增加,成本上升使资源有限组织难复现结果,且新模型定价、按需分配推理token也让成本更复杂。

DeeplearningAI
算法论文8

推理时间减少70%!前馈3DGS「压缩神器」来了,浙大Monash联合出品

在AR、VR等领域,3DGS是新视角合成(NVS)领域备受关注的技术方案。现有前馈3DGS模型存在编码器容量有限等问题,ZIP Lab和Monash团队引入信息瓶颈原理,推出轻量级模块ZPressor,有效解决信息过载难题。

量子位
新闻资讯8

AICon 2025 深圳回顾:AI Agent 爆火全场,管理与推理优化成新焦点

2025年8月22 - 23日,AICon全球人工智能开发与应用大会在深圳落幕。70+嘉宾、800+开发者与企业代表参会,议题覆盖AI Agent、推理优化等。AI Agent成全场焦点,企业管理议题意外走红,展示了AI深入各领域的趋势。

AI前线
开源动态8

Google 把翻译能力彻底开源了!TranslateGemma:550种语言通吃,还能直接看图翻译!

Google将多年积累的翻译能力灌进开源大模型TranslateGemma,它基于Gemma 3,专为翻译任务调优,有3个规模版本,覆盖550种语言,能直接看图翻译,亮点颇多。

开源星探
产品应用7

魔笔 AI Chat Builder:让 AI 对话秒变可交互界面

文章介绍阿里云魔笔AI Chat Builder,它能将AI对话变可交互界面。对比现有AI应用开发方式,阐述其综合优势,还介绍核心能力、搭建方法、多端发布等,未来将打磨能力并推新功能。

阿里云开发者
推荐文章8

Harness Engineering:耗时一周,我是如何将应用的AI Coding率提升至90%的

文章结合Anthropic、OpenAI方法论与项目实践,分享为存量Java应用构建Harness体系,将AI代码率从不到25%提至90%的方法。介绍Harness概念、现状挑战、实战步骤、关键经验及效果,还对其未来发展做了展望。

阿里云开发者
算法论文8

上海交大DENG Lab提出「LatentUM」:Unified Model的真正「战场」在视觉推理与世界模型

上海交通大学 DENG Lab 提出的 LatentUM,尝试让统一模型把生成的视觉内容纳入推理闭环。它在多项任务上超越基线,其核心思路是生成与语言共享语义空间的离散 visual semantic tokens,模型含三大关键设计。

机器之心