通用基座模型」共找到 8032 篇相关文章

算法论文8

开放世界任务成功率82%!美的攻克机器人泛化控制难题

美的AI研究院和华东师范大学联合提出ChatVLA - 2模型,引入动态混合专家架构和双阶段训练流程。真机实验显示其开放世界任务成功率达82%,远超现有方法,为通用机器人控制提供新思路。

量子位
新闻资讯8

AI「第二章」开启,未来看应用与Agent!

文章基于对一线投资机构访谈,指出AI开启新篇章,模型投资降温,应用时代来临。还探讨DeepSeek与Manus影响、Agent发展路径、AI原生硬件等多领域现状与趋势,为创业者和投资人提供参考。

探索AGI
开源动态8

一句话复刻谷歌!我用智谱新开源的GLM-4.5,把Agent开发打回了简单模式。

智谱AI深夜发布开源的新一代旗舰模型GLM - 4.5,目标成为最强Agent基座。它能一句话复刻搜索引擎,多能力原生融合,在多项测试中表现出色,推理快、价格低,还通过多关压力测试,且开源成本低。

探索AGI
开源动态8

三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!

快手开源多模态Keye-VL 1.5,为8B视频理解大模型,公开3大核心创新技术。靠Slow - Fast视频编码等,在20 + 基准屠榜。它能精确视频定位,实验显示通用、视频理解和数学推理表现佳。

CourseAI
算法论文8

超越Claude Mythos和GPT-5.5!斯坦福Agent验证框架拿下SOTA,Transformer作者转发

斯坦福、伯克利与英伟达联手打造LLM-as-a-Verifier验证框架,该方法是通用验证机制,可与任意Agent Harness和模型结合。研究表明扩展验证阶段计算量,能提升Agent整体性能,在多基准测试中超越Claude Mythos和GPT - 5.5。

量子位
开源动态8

音频全能王炸!小米MiMo-Audio开源,力压Gemini/GPT-4o!

小米团队开源通用音频大模型MiMo-Audio,集多种功能于一身,支持7国语言零样本克隆和中英混合合成。首包延迟低,效果自然稳定。在多个基准测试中表现优于Gemini-2.5-Flash和GPT-4o-Audio。

开源星探
新闻资讯7

为Token付费是一件很愚蠢的事情,用户应该为智能付费丨RockAI刘凡平@MEET2026

RockAI创始人刘凡平在量子位MEET2026大会提出,AI下一阶段要让模型“活起来”,实现硬件觉醒。他认为为Token付费愚蠢,应关注端侧智能,突破Transformer和反向传播算法,群体智能是迈向通用人工智能新路径。

量子位
产品应用8

kimi 的RL end2end ON LLM

文章分享Kimi Researcher背后技术思考,采用端到端强化学习打造大模型Agent。对比传统方法,凸显其灵活通用、能力上限高、可扩展优势。还展示其在考试榜单成绩提升及智能“涌现”,介绍多应用场景。

Agent的潜意识
算法论文8

「推理革命」爆发100天:DeepSeek-R1复现研究全揭秘!

本文深入梳理围绕DeepSeek-R1的复现研究,解析监督微调、强化学习等关键技术细节,介绍相关数据集、训练方法及奖励机制等,还探讨了推理语言模型更多发展方向,为研究提供基础。

新智元
推荐文章7

关于 AI Agent,你最想知道的 3 个问题——为什么我说“垂直 Agent”是个伪命题

文章解答了关于 AI Agent 的三个读者问题,包括概念定义、大厂推出的原因及商业化前景、通用与垂直类 Agent 的商业前景。指出 Agent 是 AI 落地有价值方向,目前有挑战,真正机会在围绕其构建的数据、工具和行业理解。

宝玉AI