「文心大模型5.0」共找到 8762 篇相关文章
企业落地 NL2SQL,需要的是 AI-ready data 和 小模型
当NL2SQL从Demo走向生产,关键是‘更干净的数据底座 + 更小的专用模型 + 更可控的工程化流程’。文章指出先数据后模型,小模型足够用且落地成本低,评估要换维度,还介绍了工程化路径等内容。
AI画手总是六根手指?阿大/美团/上交首次系统量化扩散模型计数幻觉
阿德莱德大学、美团和上海交通大学团队首次系统研究扩散模型“计数幻觉”问题。构建CountHalluSet数据集套件量化该问题,揭示其与采样条件的关系,还提出JDM模型缓解计数幻觉。
从打分器到思考者:RM-R1用推理重塑模型价值判断
伊利诺伊大学香槟分校团队提出 RM - R1 框架,将奖励建模定义为推理任务。它引入推理奖励模型和链式评估准则机制,经两阶段训练,在多基准测试中表现超大规模模型,验证了推理能力对奖励模型的重要性。
大模型推理的“左右脑”革命!华为盘古Embedded凭昇腾之力,让快慢思考合二为一
传统大模型推理面临长链条深度思考与低时延反馈的矛盾,华为盘古团队提出盘古Embedded模型。基于昇腾NPU,其采用双系统认知架构,集成“快思考”与“慢思考”双推理模式,实现推理效率与精度协同提升。
GPT-5.2首发评测:大神深度体验两周,强到离谱,但慢得抓狂
为对抗谷歌的Gemini 3,OpenAI推出GPT - 5.2。大神Matt Shumer深度评测,指出其指令遵循、代码生成、视觉和长上下文等能力有提升,但速度慢。与Claude Opus 4.5、Gemini 3 Pro各有分工。
5.3 万人收藏的开源版 Claude Code 彻底起飞了,GLM-4.7直接免费用。
近期AI编程界,Claude Code虽好用但对小白不友好。而开源神作OpenCode爆火,Star数达53K。它把‘选模型’进化成‘选员工’,有图形化界面,还集成可靠模型,支持并行运行,社区有强大插件。
Mamba 架构实现推理性能超 Gemma3-27B!推理模型开始迈入「无注意力」时代
PromptCoT - Mamba是首个具解码显存常量等特性且推理能力强的模型。当前推理大模型中注意力机制有局限,PromptCoT - Mamba实现无注意力推理,在多评测集超Transformer等模型,为无注意力推理生态奠基。
震惊海外开发者!BOSS直聘3B小模型比肩80B,怎么做到的?
BOSS直聘楠北阁团队发布3B轻量端侧小模型Nanbeige4.1-3B,性能震惊海外开发者。团队从多方面改进,如优化推理和偏好对齐,重构训练数据,采用多种强化学习算法,使其性能比肩大模型。
OpenAI发布GPT-5-Codex:独立编码7小时,能动态调整资源,token消耗更少
OpenAI发布专用于编程的GPT-5-Codex,属GPT-5特殊版本,有即时协作和独立执行的‘双模’特长。它能动态调整资源,token消耗少,擅代码审查。文中还介绍其命名由来及编程智能体竞争情况。
神秘模型排名超 Gemma 4 31B:不跟 Qwen 硬刚,主打“快”和“省 token”
OpenRouter的Elephant模型Trending榜排名超Gemma 4 31B。它是100B参数隐身模型,主打‘智能效率’,在速度、token消耗、指令遵循等方面与其他100B级别模型对比各有优劣,代表极致轻量路线。