「MiMo-V2.5-Pro」共找到 3418 篇相关文章
我用GLM-5肝出一个Rust版Agent系统,Opus 4.6迎来了最强开源对手。
作者实测智谱发布的GLM - 5后,用其开发出Rust版Agent系统并开源。还对比GLM - 5与Kimi 2.5、Opus 4.6,认为GLM - 5写后端能力强,让普通开发者也能用高级架构能力。
GPT-5.2破解数论猜想获陶哲轩认证!OpenAI副总裁曝大动作:正改模型核心设计,吊打90%研究生但难出颠覆性发现
OpenAI 发布由 GPT - 5.2 加持的科研平台 Prism 并免费开放。副总裁 Kevin Weil 称目前模型难有颠覆性发现,但能加速科研。GPT - 5 能力超 90% 研究生,OpenAI 将优化其设计,让它更谦逊并自我核查。
字节最强多模态模型登陆火山引擎!Seed1.5-VL靠20B激活参数狂揽38项SOTA
5月13日,火山引擎在上海发布5款模型和产品,其中豆包1.5・视觉深度思考模型(Seed1.5-VL)最吸睛。它激活参数20B,性能与Gemini2.5 Pro相当,38个评测基准达SOTA,推理成本低,已开放API。
刚刚,Claude Fable 5续命5天!省钱攻略来了
7月7日凌晨,Anthropic官宣最强Claude Fable 5限时免费延长到7月12日。开发者给出自救方法,Anthropic也甩出顾问和编排者两套省钱架构,实现成本降低效果。
登顶多模态推理榜MMMU!UCSD新方法超越GPT-5、Gemini
加州大学圣地亚哥分校团队开发的DreamPRM-1.5在MMMU测评榜夺冠,超越GPT-5、Gemini 2.5 Pro Deep-Think。它细化加权粒度到样本,有Instance Table和Instance Net架构,采用双层优化与生成式奖励模型。
Claude Fable 5.1与GPT-5.6社区一手实测
Anthropic的Claude Fable 5.1刚上线,社区就将其与OpenAI的GPT - 5.6 Sol实战对决。采用同一提示词等严苛规则,结果Fable 5.1细节碾压但有bug,成本高;GPT - 5.6 Sol成本低、风格稳定。还给出选型参考。
GPT-5.5 Instant发布:人人免费,幻觉暴降52.5%
OpenAI发布GPT-5.5 Instant,全面替代老版本成默认选择。新模型降低高风险领域幻觉比例,回答更精简,能调用过往聊天和邮箱信息提供专属反馈,且人人免费。
曝GPT-5.5用上「全球最快芯片」,Claude慌了!
新智元报道,OpenAI的GPT - 5.3 - Codex - Spark用Cerebras的WSE - 3芯片达2000 token/秒。Cerebras CFO称在跑GPT - 5.4和GPT - 5.5,但SemiAnalysis报告指出其跑大模型有短板,且公开云模型小、上下文短。
5V5电竞版Prompt Battle来了,这是AIFUT大会最后的总结。
AIFUT大会结束,最后半天有圆桌、演讲与Prompt Battle电竞赛。余轶南谈具身智能和家庭机器人;5v5电竞赛红队夺冠;神思远等探讨影视行业;快刀青衣等交流AI创业;张泓等讨论AI投资;吕思彤分享开发经验。
大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金
新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。