代码大模型」共找到 9950 篇相关文章

新闻资讯7

MMAR与AudioTrust技术解读,音频模型评测前沿进展分享 | AI Bench Talk直播预告

司南评测集社区 CompassHub 收录多维度评测集。此次 AI Bench Talk 直播聚焦音频模型,将分享评估其深度推理能力的 MMAR 及全方位可信评估框架 AudioTrust,还设圆桌讨论多模态/音频模型相关议题。

OpenMMLab
算法论文8

陈丹琦新作:模型强化学习的第三条路,8B小模型超越GPT-4o

陈丹琦团队提出结合RLHF和RLVR优点的RLMT方法,支持在基础模型上直接使用,节省后训练成本。它让模型生成CoT,用奖励模型评价输出,使小模型超越模型,推理更像人类。

量子位
产品应用8

模型“跑”在手机里:vivo蓝心端侧部署创新揭秘,性能功耗双优!

在AICon2025上海站,vivo AI研究院工程师章苏迟分享蓝心模型端侧部署方案。介绍端侧模型优势及应用场景,阐述内存、性能、功耗等指标优化方法,还提及多业务场景应对策略与安全合规措施。

InfoQ
开源动态8

微软开源2025 ICML获奖框架,终结模型多轮对话严重缺陷

微软开源2025年ICML获奖框架CoLLabLLM,可解决模型多轮对话缺陷。它由四模块构成,经多轮对话模拟和奖励优化模型。在三基准平台测试显示,能在多样任务中高效协作。

AIGC开放社区
开源动态8

央企牵头!这个AI开源社区要让模型跑遍「中国芯」

6月30日百度文心模型4.5系列开源并登陆魔乐社区,该社区发起‘模型推理适配协作计划’,想让模型跑遍中国芯。其升级工具中心和协作空间,联动产业力量,解决模型在国产芯适配难题,推动生态发展。

机器之心
算法论文8

模型多模态检索全面超越SOTA!ReCALL框架化解生成式与判别式的范式冲突|CVPR'26

紫东太初团队联合新加坡国立学攻克模型检索难题,其ReCALL框架以‘诊断 - 生成 - 校准’闭环体系解决范式冲突,让模型变身高效检索器,成果被CVPR 2026录用,刷新SOTA性能。

量子位
开源动态7

Qwen3小升级即SOTA,开源模型王座快变中国内部赛了

开源模型进入中国时间,Kimi K2风头正盛时,Qwen3迎来升级,235B总参数量仅为Kimi K2四分之一,基准测试性能却超它。Qwen官方不再用混合思维模式,新模型仅支持非思考模式,此次是小更新,招在后头。

量子位
算法论文8

10行代码,AIME24/25提高15%!揭秘模型强化学习熵机制

来自多机构的研究者揭示模型强化学习中熵变化机制。发现策略熵在训练中急剧下降致性能停滞,提出 Clip - Cov 与 KL - Cov 两种正则化技术调控高协方差标记,遏制熵塌缩,在部分数据集上性能提升显著。

机器之心
算法论文8

LLM-in-Sandbox:给模型一台电脑,激发通用智能体能力

来自中国人民学、微软研究院和清华的研究者提出LLM - in - Sandbox范式,让模型代码沙盒完成任务,实验显示其能提升多领域表现,无需额外训练,还能减少token消耗,研究者认为应取代纯LLM推理。

机器之心
新闻资讯8

刚刚,智源全新「悟界」系列模型炸场!AI第一次真正「看见」宏观-微观双宇宙

6月6日第七届智源会,智源研究院推出全新「悟界」系列模型,含原生多模态世界模型Emu3、脑科学多模态通用基础模型见微Brainμ等,反映其对模型发展的研判,推动AI向物理世界迈进。

机器之心