多语言能力」共找到 6938 篇相关文章

算法论文8

JanusVLN:双重隐式记忆解耦语义与空间,开创视觉语言导航记忆新范式

视觉 - 语言导航(VLN)现有主流方法依赖显式记忆面临挑战,未充分利用3D线索。JanusVLN框架引入双重隐式神经记忆,解耦语义与空间信息,实验验证其性能、效率和泛化能力出色。

AI科技评论
新闻资讯7

Fable 5回归全网抓紧测!发现GLM-5.2更香了,价格只有1/39

Claude Fable 5消失19天后全球再上线,7月1 - 7日Pro等订阅用户可用,但额度受限。它实力强但贵,与模型对比表现优,远程工作能力突出。不过使用限制变,安全分类器易误伤。

量子位
产品应用8

Claude Sonnet 4.5发布,领域性能超越GPT-5和Gemini 2.5 Pro

Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获家公司认可。

AI工程化
算法论文8

RLHF与RLVR全都要,陈丹琦团队最新力作将推理能力拓展到通用智能

普林斯顿大学陈丹琦团队发布学术成果,提出基于模型奖励思维的强化学习(RLMT)方法,弥合专门推理与通用对话能力差距,将链式思维优势扩展到更广泛范围,提升整体对话表现。

机器之心
开源动态8

英伟达韩松团队新作:具有后神经架构搜索的高效语言模型

英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经步骤优化,代码和预训练模型将开源。

量子位
产品应用8

国产模型编程能力卷到这个程度了?MiniMax-M2.5 深度实测

文章深度实测MiniMax-M2.5编程能力,用其开发款游戏和点名工具,结果出色。还分析其底层技术,如原生Agent RL框架、过程奖励机制等,指出它性价比高,虽有不足但值得关注。

AI产品黄叔
产品应用7

姚顺雨Agent能力交卷!腾讯混元Hy3把元宝练成了打工人

腾讯混元Hy3正式版发布,总参数295B、激活参数21B,最大支持256K上下文。它是快慢思考融合的MoE模型,重点提升Coding和Agent能力。其加持下,元宝大升级,能完成办公、生活等场景任务。

量子位
开源动态8

达摩院推出智能体框架ReasonMed,打造医学推理数据生成新范式

在人工智能领域,推理语言模型在医学场景应用存在挑战,达摩院推出智能体框架ReasonMed,提出医学推理数据生成新范式,开源百万级高质量数据集ReasonMed370K,验证了‘小模型 + 高质量数据’的潜力。

机器之心
7

AI写爆款博客火出圈,主笔竟是Claude!

Anthropic为Claude开博客展示写作能力,内容经团队把关。AI写内容已不新鲜,但有翻车。普华永道研究称AI提升员工创效,重塑企业运营逻辑。公司推行AI战略,不过学生用AI作弊引担忧。

新智元
算法论文7

CoT 之后,CoF 如何让帧间逻辑从「隐式对齐」变成「显式思考」?

CoT 虽提升语言模型推理能力,但在 C 端场景有局限,且被质疑并非真实推理。视觉领域提出 CoF 概念,Google DeepMind 团队引入理论,让视频模型通过帧链推理提升帧间一致性,还具强大泛化能力

机器之心