智能体构建」共找到 4783 篇相关文章

算法论文8

告别「想完再做」卡顿!清华StreamingVLA让VLA边想边行动,提速2.4倍

视觉 - 语言 - 动作(VLA)模型“观测 - 生成 - 执行”串行模式致交互卡顿,清华与联想合作提出StreamingVLA框架,引入两项技术实现并行处理,在测试中显著提升效率和流畅度,为VLA模型部署提供新方案。

机器之心
新闻资讯7

这家初创要为AI重绘地球:可量身定制卫星星座,对接太空计算

西班牙初创公司 Xoople 完成 1.3 亿美元 B 轮融资,欲构建“地球记录系统”。它先铺管道、再造源头,与 L3Harris 合作开发天基测量系统,虽面临竞争与隐忧,但也顺应太空计算融合趋势。

DeepTech深科技
8

刘壮陈丹琦新作:开源通用视觉推理RL框架,0思考数据刷新SOTA

普林斯顿刘壮团队、陈丹琦参与推出开源通用视觉推理RL框架Vero。它构建的视觉推理器在30多项测试达8B视觉语言模型SOTA,解决了开源RL方案的问题,所有数据、代码、模型均已开源。

量子位
新闻资讯8

硅谷前沿访谈:CUDA之父复盘英伟达20年护城河,揭开万亿算力帝国的底牌

奇点智能研究院院长李建忠采访了“CUDA 之父”Ian Buck,探讨 CUDA 20 年演进、英伟达技术产品及生态。Ian Buck 介绍了 AI 基础设施新阶段,阐述 CUDA 成功原因,还谈及英伟达软硬件协同、应对竞争等问题。

AI科技大本营
新闻资讯8

中国AIGC「全家桶」来了!三箭齐发杀入全球第一梯队

3月27日,2026中关村论坛上,天工AI发布游戏世界模型Matrix - Game 3.0、视频大模型SkyReels V4和音乐大模型Mureka V9,杀入世界第一梯队,解决行业顽疾,还发布2026 AGI战略。

新智元
产品应用7

GEAClaw 来了:企业级“OpenClaw”,一只有商业头脑的龙虾

文章指出当前大语言模型解决问题多为收敛式,与商业问题需先发散再收敛的方式相悖。特赞发布企业级智能系统GEA,其架构四层分工明确,能在市场洞察、社媒增长等场景发挥作用。

AI寒武纪
开源动态8

500行极简开源框架,硬刚GPT/Gemini视觉极限!

多模态大模型代码能力进步大,但基础视觉任务常失误。UniPat AI构建SWE-Vision框架,让模型用代码处理视觉判断,在五个视觉基准测试达最优,其极简设计有效且泛化性强,代码已开源。

新智元
算法论文8

ICLR-26腾讯混元:Agent是强大的,但用户是狂野的

现有LLM工具使用基准测试场景理想化,忽视真实用户行为复杂性。腾讯提出WildToolBench,基于真实用户行为构建测试集,对58个模型评估,发现模型准确率低,揭示LLM在真实场景下能力缺口,为模型优化指明方向。

PaperAgent
新闻资讯8

种子轮10.3亿美元!谢赛宁加入,LeCun的世界模型公司太吸金了

图灵奖得主 Yann LeCun 创办的先进机器智能实验室(AMI)官宣起航,完成 10.3 亿美元种子轮融资,估值 35 亿美元,谢赛宁加盟。AMI 目标是做理解现实世界的 AI,想走世界模型路线。

机器之心
开源动态8

给GUI Agent装上「世界模型」:阿里通义用混合数据+统一思维链,让模型学会预判屏幕变化

伴随多模态大模型发展,GUI Agent成人机交互新范式,但构建高可用、跨平台的GUI Agent面临诸多挑战。阿里通义实验室开源Mobile - Agent - v3.5框架及GUI - Owl - 1.5模型家族,解决了相关技术壁垒。

量子位