多语言大模型」共找到 9883 篇相关文章

开源动态8

7.3K Star!用 Orca 组建 AI 舰队:让 Claude Code 和 Codex 同时开工!

Claude Code 大火后,家大厂推出自家 Code CLI,终端操作上下文切换成本高。Orca 是开源 AI 编排器,可让个 AI 编程助手并行工作,集中查看结果,有并行工作区、统一管理界面等亮点。

开源星探
新闻资讯7

英伟达400亿押注开源,边卖铲子边挖矿

英伟达被曝砸60亿美元押注开源模型,向Poolside投资10亿美元并买其‘模型工厂’技术非独家使用权。它主张闭源开源两手抓,此前已发布系列开源模型、组建联盟,开源布局广泛。

量子位
新闻资讯7

GLM-5.2真正的跨越:CritPt密闭物理数据集测试得分20.9%,打平Opus-4.8

GLM - 5.2在CritPt密闭物理数据集测试中表现亮眼,与Claude Opus 4.8得分并列,远超其他开源模型,还击败款闭源模型,实现4.5倍代际飞跃,标志开源模型科学推理能力进步。

AI寒武纪
新闻资讯7

上下文窗口限制被打破:Subquadratic推出了一个1200万Token的窗口

2026 年前沿模型宣传至少 100 万 Token 上下文窗口,但利用不佳。Subquadratic 推出能处理 1200 万 Token 窗口的模型,称可绕过问题,还将推 5000 万窗口模型,其 SSA 架构有优势,基准测试成绩佳。

InfoQ
新闻资讯7

刚刚,AI大牛刘威视频创业公司Video Rebirth,完成5000万美元融资

AI视频初创公司Video Rebirth完成5000万美元融资,由刘威博士创立,致力于打造“视频原生的世界模型”。融资用于视频模型迭代等,解决行业痛点,其核心创新机制让模型表现突出。

机器之心
开源动态8

刚刚,北大&360里程碑式突破!32B安全分碾压千亿巨兽

2025年9月23日,北大 - 360联合实验室发布TinyR1 - 32B模型,仅用20k数据微调就实现安全性能突破,兼顾推理与通用能力。还推出TinyR1 - Safety - 8B,且系列模型已全面开源。

新智元
新闻资讯8

Meta归来!时隔一年发布Muse Spark,重回第一梯队

Meta发布Muse Spark模型,这是MSL团队首款模型。此前Llama 4表现不佳,刺激Meta重组。Muse Spark性能超Llama 4,计算效率提升,在测试中成绩优异,Meta AI战略转向闭源探索,模型已上线。

AIGC开放社区
推荐文章9

和一线研究员的闭门讨论:蒸馏变难后,下一步的重点是什么?

本文整理拾象邀请家头部模型厂商一线AI研究员的线下闭门讨论,围绕大模型前沿方向分享业内共识与分歧,涵盖Computer Use、RSI、模型蒸馏、训练数据、数据生意等核心议题,干货密度高。

海外独角兽
开源动态8

DeepSeek-R1发布后的100天复现之旅方法总结

DeepSeek团队发布「推理大模型」DeepSeek-R1 ,其技术细节未完全开源,全球研究团队开启“复现竞赛”。论文总结100天复现经验,介绍推理大模型与普通大模型区别、复现方法、关键发现及未来方向。

深度学习自然语言处理
新闻资讯7

黄仁勋倡议的开源联名信,Anthropic 为何不愿签名?

黄仁勋分享支持开放权重模型的联名信,NVIDIA、Google等公司联署,Anthropic缺席遭网友讨伐。Anthropic研究人员回应引争议,这场讨论或存在错位,分歧关键在于发布前评测能否支持模型权重长期外授。

AI科技评论