「泛化推理能力」共找到 4674 篇相关文章
1美金时薪雇个全栈替身,MiniMax M2.5让打工人也能体验当老板的感觉
春节档模型大战,MiniMax官宣新模型M2.5,主打智能体和Vibe Coding,性能比肩Claude Opus 4.6。它全栈能力强,能处理长链路任务,推理吞吐量高、成本低,已接管MiniMax 30%真实业务。
智谱 GLM-4.7,Coding 开源第一,其他也很强
智谱正式发布并开源专为 Agentic Coding 打造的 GLM-4.7 模型,编程、推理、Agent 能力成绩亮眼,价格比 Claude Sonnet 4.5 更优。还推出 Coding Plan 套餐,使用方式多样。发布前几天,智谱港股招股书挂网。
一张4090就能爆改!面壁智能MiniCPM-V 4.6开源,1B多模态卷出新高度
今年是AI应用大规模落地年,参数小的端侧模型有特定场景性能优势。5月11日面壁智能开源MiniCPM-V 4.6,参数仅约1B,多模态能力超阿里、谷歌同类模型,还在多维度提升,站稳端侧多模态开源领域。
美团LongCat扎扎实实做了件难事:LLM数学新天花板AMO-Bench
美团LongCat团队联合高校推出AMO - Bench,用50道原创奥赛级难题评估LLM数学能力。它解决现有基准测试痛点,经四重把关构建,测试显示顶级模型表现不佳,也揭示模型提升空间大。
全新合成框架SOTA:强化学习当引擎,任务合成当燃料,蚂蚁港大联合出品
蚂蚁通用人工智能中心自然语言组联合香港大学自然语言组推出PromptCoT 2.0,押注任务合成。它让30B - A3B模型在数学代码推理任务达SOTA,全面升级效果、数据和方法,还将考虑多方向发展。
端到端智驾新SOTA | KnowVal:懂法律道德、有价值观的智能驾驶系统
北京大学王勇涛团队提出新型自动驾驶系统 KnowVal,通过感知与知识检索模块协同实现视觉 - 语言推理。它构建驾驶知识图谱,有价值模型用于轨迹规划,实验在多基准测试表现佳,还通过定性分析验证效果。
被 AI 大厂逼至绝望,这帮欧洲人发起了一场“科学复兴运动”
AI前沿成果被科技巨头锁在“黑箱”,欧洲科学家、工程师等发起“科学复兴运动”成立LAION。他们构建开放数据集,训练出表现优异的模型,还进行“爱丽丝梦游仙境”研究测试大模型,探讨推理模型发展方向。
西湖大学张驰团队:从视觉合成到空间理解,视频 AI 正在「转向」丨CVPR 2026
过去两年视频生成发展近成熟,但多数模型缺乏空间结构稳定建模能力。西湖大学AGI Lab团队提出论文,将问题落回推理阶段,让相机轨迹成约束条件,推进视频生成到三维结构约束建模。
离开马斯克后,他把人形机器人做成了这样
MATRIX - 3是矩阵超智推出的物理智能机器人,主打安全、自主、可泛化。公司团队背景强大,创始人张海星经验丰富。该机器人从底层到顶层重构,有三大优势,目标是走进人类生活,早期体验计划已开放。
世界模型开始做减法?LeCun团队和清华团队给出两种思路
近期,Yann LeCun团队的LeWorldModel用简洁JEPA实现从像素端到端训练世界模型,降复杂度且验证潜在空间物理刻画能力;清华团队的Fast - WAM探讨推理阶段显式生成未来必要性,给出高效替代路径。