万亿参数智能体」共找到 4078 篇相关文章

新闻资讯7

独家|红杉领投,智元旗下具身数据平台业务觅蜂科技获数亿元融资

AI科技评论独家获悉,智元机器人旗下具身智能数据平台觅蜂科技完成数亿元种子轮与天使轮融资,由红杉中国领投,多家资本跟投。此次融资用于技术研发等,觅蜂已布局全类型数据,还将建立数据联盟。

AI科技评论
算法论文8

NUS LV Lab新作|FeRA:基于「频域能量」动态路由,打破扩散模型微调的静态瓶颈

在大模型时代,参数高效微调(PEFT)已成为迁移大规模扩散模型至下游任务的标准范式。但现有微调方法多采用「静态」策略,忽略扩散生成过程内在规律。新加坡国立大学LV Lab等机构提出FeRA框架,通过频域能量动态路由,实现高效微调。

机器之心
开源动态7

跳过“逐字生成”!蚂蚁集团赵俊博:扩散模型让我们能直接修改Token | MEET2026

在量子位MEET2026智能未来大会上,蚂蚁集团赵俊博称扩散架构能直接修改控制token,理论上速度更快、成本更低。他团队押注扩散架构,近期开源千亿规模LLaDA 2.0。该领域虽处早期,但发展快,吸引众多巨头和初创公司布局。

量子位
算法论文8

AAAI 2026 Oral:明略科技开创稀疏数据「信息瓶颈动态压缩」,精度+速度双SOTA

在机器人和具身智能领域,transformer模型又大又‘重’,边缘设备难以承受。东南大学、中南大学、明略科技联合提出的CompTrack论文,创新性解决AI模型处理稀疏数据的‘双重冗余’,在3D点云跟踪任务上实现精度和速度双优。

机器之心
7

苹果不吹 AI,反而成功了?

北京时间9月10日苹果发布会,新款iPhone等产品更新。此次发布会多数环节AI几乎消失,与iPhone 16发布时大肆宣传不同。苹果因在智能体AI助手进展落后,重点放硬件及AI幕后支持。不过苹果仍承受分析师压力,且在AI竞赛中落后。

AI前线
算法论文8

大模型如何"不训练"也能学习?——上下文学习的隐式权重更新机制

大型语言模型能通过上下文学习(ICL)在推理时即时学习新任务,无需修改模型参数。本文首次证明自注意力层与MLP层组合能隐式将上下文信息转为MLP层低秩权重更新,解释了ICL原理,为构建AI系统开辟新路径。

深度学习自然语言处理
新闻资讯7

MCP 走向无状态,开发者追问:这不就又变回 API 了吗?

MCP 2026 - 07 - 28 规范取消协议会话,新增必需 HTTP 标头,可对智能体流量路由等。社区反应分歧大,有人认为无状态让 MCP 变回 REST API,也有人强调它是获 AI 提供商认可的标准。MCP SDK 下载量高,但服务器使用存问题。

InfoQ
推荐文章7

AI终点不是算法,而是业务成果 | 云徙科技@MEET2026

大模型时代,基础模型参数规模不断增大,但企业核心业务中AI真实渗透率低。云徙科技执行总裁毛健认为,AI终点是业务成果,应是‘运营×AI’,还指出AI跃迁为业务主体面临四重鸿沟,云徙科技提出破局方法并分享落地案例。

量子位
产品应用3

小美Agent:当龙猫遇到美团外卖的灾难现场

作者体验美团AI助手“小美”后吐槽不断。美团称其用有5600亿参数的龙猫大模型,能力接近GPT - 4o,但它理解需求差、操作订单无效、定位混乱。美团做AI是为跟风,未解决用户真需求,是资源浪费。

AI产品黄叔
算法论文8

为什么GPT-5算得出微积分,却数不清积木?

文章对GPT - 5展开系统化空间能力测评,涵盖8个基准、超10亿token成本。提出“空间智能六维图谱”,发现GPT - 5在MM和SR达人类水平,但MR、PT等方面有短板,还揭示闭源与开源模型在复杂任务上差距小等情况。

深度学习自然语言处理