多模态智能体」共找到 4133 篇相关文章

新闻资讯7

CVPR 2026 Workshop征稿|第六届AdvML@CV:多模态大模型智能安全

IEEE/CVF 计算机视觉与模式识别会议 CVPR 2026 6月3 - 7日在美国丹佛举办,期间6月3或4日将举办第六届对抗机器学习计算机视觉研讨会,聚焦视觉 - 语言智能安全,现开启论文征稿并公布重要日期,给出投稿入口。

机器之心
开源动态8

GitHub Trending 榜一的开源 Cowork 来了!4天4.5K星,首个多智能工作流应用!

开源项目Eigent冲上GitHub Trending榜首,4天获4.5K+ Star。它是全球首个多智能工作流桌面应用,完全开源、支持本地模型,有多种智能工作流,具备本地优先、并行工作流等特性,提供三种使用模式。

开源星探
开源动态8

智能编程“小钢炮”:Qwen3.6-35B-A3B开源!

Qwen3.6-35B-A3B开源,是稀疏MoE模型,总参350亿、激活参数30亿,轻量高效,在智能编程等方面表现卓越,超越前代,可与稠密模型媲美,支持多模态,已在Qwen Studio上线并发布开源权重。

千问大模型
算法论文8

只需1/4预算,性能反超基线:阿里高德提出Tree-GRPO,高效破解智能RL难题

阿里高德提出Tree - GRPO方法解决智能RL难题。它以智能步骤为节点树搜索,在11个数据集中更省预算、表现更好,能在1/4预算超GRPO基线,解决了Rollout成本高和监督稀疏问题。

机器之心
算法论文8

高效智能的「幕后推手」是谁?一篇综述带你从记忆×工具学习×规划看透

随着大模型能力提升,业界关注智能落地,而高效性是决定能否上线的‘硬’问题。论文梳理‘高效智能’综述,从记忆、工具学习、规划三机制出发,还谈及基准评测、挑战与展望。

机器之心
算法论文8

SimpAgent (ICCV2025 Highlight):上下⽂简化重塑GUI智能,更少计算,更强性能

多模态大模型加持下,纯视觉GUI智能成通用操作智能重要方向,但面临元素与历史上下文问题。哈工深和华为提出SimpAgent,从上下文简化建模入手,实现更快更强性能,工作被ICCV 2025录用。

AI科技评论
推荐文章7

编程智能的核心组件【译】(重发,补图)

文章围绕编程智能展开,先厘清大语言模型、推理模型与智能关系,指出智能是含‘模型 + 工具 + 记忆 + 环境反馈’的循环系统,后介绍编程智能六大核心组件,还对比了与 OpenClaw 的区别。

宝玉AI
算法论文8

上交、清华、微软、上海AI Lab等联合发布数据分析智能综述,LLM化身数据分析师,让数据自己「说话」

传统数据分析方法耦合度高、扩展性差,大语言模型与智能让数据分析迈向“语义理解”。上交、清华等机构联合撰写综述,回顾演进,提出新范式,总结关键技术、趋势及挑战,推动通用数据分析智能发展。

机器之心
推荐文章8

每天审200个PR、每月3000个Issue?智能开始并行写代码,人类可能成最薄弱环节

本文是对微软 VS Code 团队工程经理 Kai Maetzel 的访谈。他回顾了 VS Code 发展历程,分享 AI 编程、智能开发及开发者工具设计的实践思考,如 AI 补全验优化、智能开发权衡、与 IDE 交互机制等,还探讨了未来发展挑战与趋势。

InfoQ
新闻资讯7

当 70% 的人将拥有智能,谁来给 AI 建底座?澜舟科技周明:大模型落地的最后一道墙是“可信 AI”

4月16日澜舟科技春季沟通会,创始人周明分享智能到数字员工演进等内容。指出AI进入落地新阶段,提出可信AI和智能工程,展示相关技术系、产品矩阵及行业方案,回答企业级AI现实问题。

AI科技大本营