「V3.1模型」共找到 9068 篇相关文章
攻克大模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0
9月19日,蚂蚁百灵大模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型性能,降低推理成本。
字节暂停 Seedance2.0 全球发布,回应武汉全员被裁;曝梁文锋将携 DeepSeek V4 撞上姚顺雨;央视 315 曝光黑灰产“养号工厂” | AI周报
本期 AI 周报涵盖多领域动态。模型方面,DeepSeek-V4 将上线,姚顺雨将发布混元新模型;字节因版权纠纷暂停 Seedance 2.0 全球发布。企业动态有腾讯云模型调价、微信研发自有模型等,还有多起融资、收购事件。
Anthropic发布Fable 5.1:科研、编程能力翻倍,成本最高降45%
当地时间9月1日,Anthropic推出Claude Fable 5.1和Claude Mythos 5.1。Fable 5.1科研、编程能力翻倍,成本最高降45%,还能解决实际问题,此次模型竞争转向多方面综合较量。
开源版MetaQuery来了!OpenUni用1.1B参数媲美BLIP3-o-8B,数据代码完全开源
南洋理工大学 S-Lab 和商汤科技团队推出开源版 MetaQuery——OpenUni,仅 1.1B 参数达 8B 模型性能,代码、权重、数据全开源。它架构极简、参数高效,还继承了多模态理解能力。
DeepSeek-R1 更新,思考更深,推理更强
DeepSeek R1 模型完成小版本升级至 DeepSeek - R1 - 0528,用户可在官网、APP 等体验,API 同步更新。该版本强化深度思考能力,在多基准测评表现优异,还改善幻觉、提升创意写作等能力。
叛变!OpenAI亲儿子竟然选了Kimi K3
OpenAI投资的法律AI公司Harvey,首个自研模型Harvey Tenet选中国开源模型Kimi K3作底座。因原用闭源模型成本高、有竞争风险。Tenet训练成本低、性能佳,显示出可复制路径。
1B 参数跑出 2B 性能?面壁 MiniCPM5-1B 用 AI 自进化,提速 AGI 进程
全球AI行业陷入资源消耗战,面壁智能绕开物理瓶颈,提出“AI制造AI”路径。2026年5月25日发布MiniCPM5-1B,有越级性能、极致压缩比和均衡能力,源于“模型、框架、数据”自进化范式。
国产「3D版Anthropic」再获数亿融资!60人初创,卡住全球3D脖子
影眸科技完成数亿元新一轮融资,发布全球首个具千万面级生成能力、引入‘先思考、再生成’逻辑的3D大模型Hyper3D Rodin Gen - 2.5。其有诸多优势,获多巨头认可,目标是定义空间智能底层规则。
1.5B参数!支持本地实时语音转录
Liquid AI发布首个端到端音频基础模型LFM2 - Audio - 1.5B,参数1.5B,能在本地设备处理高质量端到端音频任务。它是统一多模态模型,支持两种生成策略,多种应用场景,虽仅支持英文但性能出色。
云计算一哥首度牵手OpenAI,大模型「选择」自由,才是终极胜利
亚马逊云科技宣布通过两大平台支持OpenAI新开源模型,还上线Anthropic最新模型Claude Opus 4.1。其早有战略布局,两大平台汇聚400+模型,践行‘选择大于一切’理念,满足多样需求,打造AI生态。