M2.5」共找到 3348 篇相关文章

新闻资讯8

MiniMax ARR暴涨500%,token暴涨2000%!这就是Agent红利吧

MiniMax最新数据显示,今年8月ARR超8亿美元,较2月增长约5.3倍。2026年上半年收入同比涨283.1%,B端收入占比升至80%。其增长得益于用户增多和用法改变,M3、H3模型表现出色。

量子位
算法论文7

BesiegeField:LLM能否学会设计机器?

香港中文大学推出基于游戏《Besiege》的测试平台BesiegeField,探讨LLM能否学会设计机器。研究通过组合式机器设计视角,测试LLM,提出多智能体迭代设计流程等,发现LLM有挑战但并非不可实现,如Gemini 2.5 Pro表现不错。

带你学AI
产品应用7

Cursor新模型,你怎么还在套Kimi?马斯克你怎么还吆喝上了??

Cursor模型更新至Composer 2.5,测评成绩亮眼,性能接近Claude Opus 4.7,价格仅为其1/10。该模型以Kimi打底,在训练栈上做了改进。此外,Cursor与马斯克达成算力合作,走上自研之路。

量子位
算法论文8

混合数学编程逻辑数据,一次性提升AI多领域强化学习能力 | 上海AI Lab

上海AI Lab的OpenDataLab团队通过大规模实验剖析RLVR在多领域推理机制。构建多领域评估框架与定制奖励策略,基于Qwen2.5 - 7B系列模型联合训练,有多项关键发现,为构建AI推理模型提供参考。

量子位
开源动态8

别问树模型了!死磕结构化数据,清华团队把大模型表格理解推到极限

AI 时代处理结构化数据成痛点,LLM 大模型难以满足生产要求。清华大学与稳准智能联合发布的 LimiX 系列模型,做到真正通用,在跑分和实际落地表现出色,其轻量级版本 LimiX - 2M 适合边缘设备和科研场景。

机器之心
开源动态8

牛!小米开源「音频语言模型」,超1亿小时预训练时间,音频理解和输出能力是真顶!

小米推出开源音频语言模型MiMo - Audio,有超1亿小时预训练时间。它能理解音频,70亿参数模型在多基准测试达SOTA,音频理解超Gemini - 2.5 - Flash,复杂推理优于GPT - 4o - Audio,还支持多模态任务。

开源AI项目落地
新闻资讯7

一个Bug改通宵!用AI写超50%代码,只有32%资深开发者敢这么干

Fastly对美国开发者做AI生产力调研,发现高级开发者用AI交付代码量是初学者2.5倍,也揭示AI编码隐形成本。高级开发者更信任AI,而初级开发者因经验不足更谨慎,同时调研还涉及绿色编码认知。

新智元
产品应用8

vivo发布端侧多模态模型,只有3B可理解GUI界面,20项评测表现亮眼

vivo AI Lab发布端侧多模态模型BlueLM - 2.5 - 3B,融合文本与图文能力,支持长短思考模式切换。它在20余项评测中表现出色,参数量小,训练和推理成本低,有精巧结构、高效策略,还有高质量数据和高性能平台支撑。

量子位
产品应用8

医疗幻觉率比DeepSeek低3倍,百川循证增强大模型横扫全球医学考试!

百川智能发布首个循证增强医疗大模型Baichuan - M2 Plus,将循证医学理念融入训练和推理,首创六源循证范式。其在多场景评测中幻觉率低,多国医考成绩优异,已上线百小应APP并开放API。

新智元
新闻资讯8

账上仍有30亿元现金,王小川不下牌桌|甲子光年

1月13日百川智能开源新一代医疗大模型Baichuan - M3,在医疗AI评测中夺冠,超越GPT - 5.2。王小川带领百川转型AI医疗,虽面临挑战但账上有30亿现金,选择院外商业化,预计2027年考虑上市。

甲子光年