大模型智能体」共找到 10725 篇相关文章

算法论文8

NeurIPS 2025 Spotlight | 条件表征学习:一步对齐表征与准则

文章指出传统表征学习处理图片和商品信息时存在局限,针对性有监督训练成本高,多模态模型使用成本也需考虑。为此提出即插即用的条件表征学习方法 CRL,实验显示其在下游任务表现优异。

机器之心
算法论文8

ICCV 2025 | 清华&腾讯混元X发现「视觉头」机制:仅5%注意力头负责多模态视觉理解

本文聚焦多模态模型,提出基于 OCR 任务量化注意力头视觉偏好的方法,发现仅不到 5%“视觉头”主导视觉理解。还提出 SparseMM 策略优化 KV - Cache 资源分配,经多基准评测,性能和效率表现优。

机器之心
推荐文章7

AI Agent 十问十答,降低认知摩擦

文章以问答形式梳理技术术语与价值信息,介绍AI Agent定义、与传统软件区别、演进原因等,还阐述组件、原理、提升输出效果方法,探讨Workflow与LLM关系及单/多智能体系统相关内容。

阿里云开发者
推荐文章8

Anthropic:这样构建Agent,性能提升90%!

Anthropic分享从0到1构建多智能体DeepResearch系统的方法,该系统是Claude内置Research功能。干货多,涵盖架构设计、Prompt工程等。多智能体性能比单模型高90.2%,但烧钱,适合高价值复杂任务。

探索AGI
新闻资讯8

没有老黄不夸的中国公司了吧??

英伟达CEO黄仁勋访华期间,在高密度采访交流中对中国公司、技术赞不绝口。他夸雷军和小米,评蔚小理、华为、DeepSeek等,还看好中国模型、机器人等领域,此外也谈及英伟达合作、AI发展等问题。

量子位
产品应用7

Claude Sonnet 5:更强,但更贵,每任务成本反超Opus 4.8

Anthropic 发布的 Claude Sonnet 5 智能指数追平 GPT - 5.5,但每任务成本比 Opus 4.8 贵 15%。它在知识工作类任务表现佳,推出促销价,不过促销后成本待察。评估迁移时需算 token 消耗。

AI工程化
新闻资讯7

AI助手Cici悄然霸榜海外,又是字节

AI智能助手领域有新玩家,字节跳动的Cici在多个国家应用商店霸榜,数月内下载量爆发式增长。它融合字节旗下技术,文本生成用到OpenAI、谷歌模型。同时,豆包在国内AI智能助手赛道全维度领先。

量子位
新闻资讯7

2025年了,AI还看不懂时钟!90%人都能答对,顶尖AI全军覆没

AI基准ClockBench测试AI读模拟时钟能力,人类平均准确率89.1%,11个主流模型最好仅13.3%。研究展示了LLM局限性,分析了可能原因,还对比了不同模型表现及在各类问题上的差异。

新智元
开源动态8

Meta刚刚开源DINOv3,横扫60+任务,无标注封神!

今天凌晨,Meta开源视觉模型DINOv3,采用自我监督学习,无需标注数据。它在60多个视觉任务测试中表现出色,超越同类模型。还引入后处理优化策略,扩展应用场景,能适应多种部署环境。

AIGC开放社区
新闻资讯7

阿里千问负责人林俊旸突然离职,Qwen 开源时代要变了吗?

3月4日凌晨,千问核心负责人林俊旸在X发文卸任,3月3日下午他已向阿里辞职。他在阿里模型研发中贡献突出,推动Qwen3系列开源。外界猜测Qwen或转向闭源,其离职引发业内关注。

InfoQ