推理大模型」共找到 9477 篇相关文章

开源动态8

模型陷入幻觉循环,如何用工程化给它“立规矩”?

普林斯顿和伯克利研究定义“机器胡扯”,指出模型胡扯问题。蚂蚁集团旗下蚂蚁密算在2025 WAIC提出高阶程序(HOP)框架,为模型注入规则,还开源此框架,其在多行业场景应用效果良好。

InfoQ
新闻资讯7

模型私有化火了:百万一台的一体机卖疯,最赚钱的一层却没人愿干

文章指出模型私有化部署虽因合规、开源模型及国产算力发展而兴起,但利润结构呈哑铃状。算力层规模但毛利低,模型层因开源难盈利,交付层最赚钱却因项目制难规模化,国际市场也类似。

AI Reading Hub
新闻资讯8

中兴星云拿下推理总分榜一!SuperCLUE 5月成绩出炉

2025年全球AI模型竞赛激烈,SuperCLUE发布5月报告,中兴通讯星云模型Nebula Coder - V6推理专项榜单总分并列第一、总榜并列第二,细分赛道表现佳,且是少数获国家级权威安全认证的模型

新智元
新闻资讯8

5款模型考「山东卷」,Gemini、豆包分别获文理第一名

近日,字节跳动Seed团队用2025年山东高考真题对5款模型进行全科闭卷测评。结果显示,豆包Seed1.6 - Thinking获文科第一,Gemini 2.5 Pro获理科第一。模型一年间进步显著,未来或融入更多领域。

机器之心
推荐文章8

揭秘千卡 GPU 集群如何高效训练多模态模型:vivo AI 团队实战经验分享|AICon

在 InfoQ 举办的 AICon 会上,vivo AI 架构师王兆雄分享多模态模型训练经验。介绍了 LLaVA 和 DiT 模型训练挑战,从数据处理、模型计算等方面提出优化策略,还展望 AI Infra 未来发展方向。

AI前线
新闻资讯7

新“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了

“欧洲的OpenAI”Mistral AI发布首款推理模型Magistral,却再遭质疑未与最新版Qwen和DeepSeek R1对比。该模型亮点是支持多语言推理,以纯RL方式训练,为LLM强化学习提供新范式。

量子位
开源动态8

【万字长文】模型开源开发全景与趋势解读

本文以蚂蚁开源团队视角,基于OpenDigger数据,分析模型开源开发生态。呈现2025年全景图,涵盖135项目。指出训练、推理、应用侧主导领域,还探讨生态趋势、项目兴衰及近期厂商动态。

InfoQ
新闻资讯7

不再“纸上谈兵”:模型能力如何转化为实际业务价值

InfoQ《极客有约》X AICon 直播栏目邀华为云郑岩、蚂蚁集团杨浩、明略科技吴昊宇,探讨模型驱动业务提效。分享场景探索、技术落地经验,如选模型考量因素、AI Agent 创新等,还提及 MCP 应用与未来展望。

AI前线
产品应用7

我让10个模型又参加了完整版数学高考,第一名居然是它。。。

作者让10个模型参加完整版数学高考,单独制定规则,邀朋友协助测试。结果令人意外,单选题第6题成噩梦,多模态题模型几乎全军覆没。讯飞星火和豆包145分并列第一,Qwen3屈居第三。

数字生命卡兹克
新闻资讯7

78%主创跳槽!Llama 14名作者只剩3人,Meta最强开源模型团队溃散引争议

据外媒消息,Meta面临严重人才流失,Llama模型14位核心作者中11位离职,或自立门户或跳槽。同时,Meta模型研发进度缓慢,旗舰模型屡次延期,一边裁员一边押注AI,且寻求资金支持遇冷。

AI科技大本营