多语言大模型」共找到 9879 篇相关文章

算法论文8

让RAG真正读懂“言外之意”!新框架引入词汇样性,刷新项基准SOTA

ACL 2025研究提出Lexical Diversity - aware RAG (DRAG) 框架,将词汇样性引入RAG检索与生成,解决现有方法痛点。它有两大创新模块,实验在基准提升准确率,还将在模型上增益,代码即将开源。

量子位
算法论文8

从「记忆解题」到「深度推理」:港科大推出首个本科数学动态评测基准 UGMathBench

港科大团队发表在 ICLR 2025 的研究 UGMathBench,是首个本科数学动态评测体系。它涵盖 16 个学科领域,通过变量扰动创建版本试题,引入创新指标评估模型推理能力,测试结果揭示了当前模型短板。

AI科技大本营
算法论文8

DeepSeek-GRPO重要性权重设计错误?详解Qwen3新强化学习算法GSPO

论文指出GRPO在大语言模型训练中不稳定,因其重要性权重设计错误易引入高方差噪声。为此提出GSPO算法,从序列维度计算梯度,解决了MoE模型RL训练的稳定性问题,在Qwen3上效率更高。

深度学习自然语言处理
算法论文7

The Batch: 919 | 本地 AI 能否替代云端?

语言模型预测输出需求推动数据中心扩建,研究人员探讨本地小型模型能否分担算力负荷。斯坦福与Together AI团队研究发现,本地系统单瓦特智能量与云端有差距但在缩小,若准确率相近可节省能耗。

DeeplearningAI
开源动态8

国产AI拿下国际物理奥赛金牌,13项顶级竞赛豪取12金1银,划重点:开源

上海人工智能实验室团队推出开源模型家族P1,在IPhO 2025理论考试中,P1-235B-A22B成首个达金牌线的开源模型。引入PhysicsMinions后成绩提升,在HiPhO基准排名第一,且全链路开源。

量子位
算法论文7

Meta|提出RECAP,通过动态目标重加权回放,解决RLVR遗忘【文末送书!Agent相关】

近年来,可验证奖励强化学习(RLVR)提升了大模型任务上的性能,但带来“能力退化”问题。Meta等提出RECAP策略,结合“回放”与“动态目标重加权”,保持模型通用能力,提升推理性能,还提高推理效率。

AINLPer
产品应用7

6个Agent组团Vibe Gaming:自己生成、试玩、修Bug

过去大模型生成的游戏虽代码能跑,但常陷入“可玩性黑洞”。Spellcaster让个专用Agent协同处理,形成“生成—运行—检查—修复”循环。目前能快速生成种游戏原型,未来将用世界模型直接生成画面。

量子位
开源动态8

vivo自研蓝河操作系统内核开源!Rust开发新机遇来了

vivo宣布开源自研蓝河操作系统内核,它由Rust语言编写,解决了传统C语言难题,更轻量化、对硬件要求低且支持架构。此次开源不仅是国产操作系统突破创新,还将推动Rust生态发展。

量子位
产品应用8

超10万亿Tokens的高质量数据集是怎么炼成的?专访中国电信天翼AI阮宜龙

中国电信天翼AI打造超10万亿Tokens高质量数据集,依托星辰MaaS平台构建“数据—模型—服务”闭环。其与研究院推进技术研发并落地产品,建“三全”星辰大模型体系,还在行业展现应用价值。

量子位
新闻资讯7

世纪反转:“安卓爹”谷歌成 iPhone“大脑供应商”?曝苹果每年掏70亿换定制Gemini,明年上线新Siri

彭博社报道苹果将与谷歌合作,每年付约10亿美元获定制Gemini用于升级Siri,计划明年春季推出。谷歌模型参数远超苹果现有模型,能让Siri功能更强大,且运行在苹果私有云。

AI前线