效果提升」共找到 3510 篇相关文章

算法论文8

告别「盲目自信」,CCD:扩散语言模型推理新SOTA

华为小艺香港团队等研究人员提出上下文一致性解码算法(CCD)。它解决传统DLM推理“短视”和采样预算固化问题,在开源DLMs上实现3.48倍加速和3.9%性能提升,适配多种解码设定。

机器之心
算法论文8

美团LongCat扎扎实实做了件难事:LLM数学新天花板AMO-Bench

美团LongCat团队联合高校推出AMO - Bench,用50道原创奥赛级难题评估LLM数学能力。它解决现有基准测试痛点,经四重把关构建,测试显示顶级模型表现不佳,也揭示模型提升空间大。

PaperAgent
算法论文8

让大模型学会「心灵感应」:基于思维沟通的多智能体合作范式来了

NeurIPS 2025的论文提出思维沟通概念,建立潜在思维可识别性理论,构建ThoughtComm框架。该框架让模型共享潜在思维,跳过语言冗余歧义,实验显示其提升了协作效率与推理能力,或开启新智能形态。

机器之心
开源动态8

全新合成框架SOTA:强化学习当引擎,任务合成当燃料,蚂蚁港大联合出品

蚂蚁通用人工智能中心自然语言组联合香港大学自然语言组推出PromptCoT 2.0,押注任务合成。它让30B - A3B模型在数学代码推理任务达SOTA,全面升级效果、数据和方法,还将考虑多方向发展。

量子位
新闻资讯8

刚刚,OpenAI Sora 2重磅登场!首个APP上线,或将成为AI时代新TikTok

凌晨1点,OpenAI推出Sora 2,AI视频迎来「GPT - 3.5时刻」。它物理智能提升、实现音画同步,人物一致性等刷新SOTA。Sora App上线或重塑短视频交互与社区互动,还在安全治理上布下多层防线。

新智元
算法论文8

破解人机协作密码:工作技能拆成两层,AI执行人类决策成功率狂飙 | ICML 2025

耶鲁和南大研究人员合作的论文提出数学框架,把工作技能拆分为决策层和执行层子技能,揭示人类与AI在这两层面各有所长,优势互补可提升成功率,还为机构适应新工作体系提供指南。

量子位
7

AI 赋能 eBay 支付风控:从用户行为到交易安全的全面智能化|AICon 北京

6月27 - 28日AICon全球人工智能开发与应用大会北京站将举办,eBay高级技术专家魏瑶将分享《AI赋能eBay支付风控》。eBay用AI提升风控能力,也面临挑战并提出方案,大会还有多专题论坛。

InfoQ
开源动态8

月之暗面刚开源多模态Kimi-2506:智能体、视觉理解,重磅大升级

国内月之暗面平台对开源多模态模型Kimi-VL-A3B-Thinking升级到2506版本。该版本性能、视觉理解等能力提升,支持更高分辨率,在多领域表现出色,还介绍了模型组成与优化器改进。

AIGC开放社区
开源动态8

智元机器人发布并开源首个机器人动作序列驱动的世界模型

智元机器人发布并开源全球首个基于机器人动作序列驱动的具身世界模型 EVAC 及具身世界模型评测基准 EWMBench,构建全新开发范式,解决具身智能演进制约,提升策略模型筛选与训练效率。

InfoQ
算法论文8

LLM后训练太烧钱?清华&腾讯有了破解法门:关键是得会Rollout

大模型强化学习后训练中,rollout预算易成瓶颈,且并非所有rollout都有用。清华和腾讯研究者提出TRACE框架,将Agent轨迹视为树,分配预算给易产生“成功/失败对比”的节点,实验显示其效果良好。

量子位