「智能体构建」共找到 4728 篇相关文章
每天审200个PR、每月3000个Issue?智能体开始并行写代码,人类可能成最薄弱环节
本文是对微软 VS Code 团队工程经理 Kai Maetzel 的访谈。他回顾了 VS Code 发展历程,分享 AI 编程、智能体开发及开发者工具设计的实践思考,如 AI 补全体验优化、智能体开发权衡、与 IDE 交互机制等,还探讨了未来发展挑战与趋势。
为AI智能体选型、验收、优化提供量化依据:首部评估标准公开征集中
AI智能体成2025年十大战略技术趋势之首,到2028年至少15%日常工作决策将由其自主做出。但企业面临信任鸿沟,缺乏评估规范。首部聚焦AI智能体应用的团体标准公开征集起草单位与起草人,适用于多方,有核心内容与价值。
首个GUI多模态大模型智能体可信评测框架+基准:MLA-Trust
MLA-Trust 是首个针对 GUI 环境下多模态大模型智能体的可信度评测框架,构建了涵盖四核心维度的评估体系,对 13 个模型深度评估,揭示可信度风险,还提供评估工具箱,推动其可靠部署。
人大高瓴-华为诺亚:大语言模型智能体记忆机制的系列研究
中国人民大学高瓴人工智能学院与华为诺亚方舟实验室聚焦大语言模型智能体记忆能力,形成含综述论文、数据集和工具包的研究体系。探讨记忆概念、重要性、实现与评测方法,还构建评测榜单、实现工具包。
当 70% 的人将拥有智能体,谁来给 AI 建底座?澜舟科技周明:大模型落地的最后一道墙是“可信 AI”
4月16日澜舟科技春季沟通会,创始人周明分享智能体到数字员工演进等内容。指出AI进入落地新阶段,提出可信AI和智能体工程,展示相关技术体系、产品矩阵及行业方案,回答企业级AI现实问题。
驭浪而行,产业向新:2025世界人工智能大会智能体论坛前瞻,共探AI产业变革|甲子光年
2025年7月28日9点,在世界人工智能大会期间,“驭浪而行 产业向新——智能体驱动产业变革论坛”将在上海世博中心举行。论坛由多方联合主办,通过三大版块探讨AI智能体产业落地痛点,有领导致辞、院士报告等多个看点。
奥特曼:ChatGPT只是意外,全能AI智能体才是真爱!Karpathy:7年前就想到了
当全球为ChatGPT喝彩,OpenAI的MathGen团队秘密锻造AI「推理」能力,打造全能AI智能体。OpenAI坚信推理能力可复制到各领域,未来AI智能体将颠覆一切,如今围绕人才的战争已白热化。
Transformer八子初创:AI横扫NP难题竞赛,Top 2%选手竟是智能体!
Transformer作者Llion Jones初创公司测试AI智能体,其在NP难题竞赛中排第21。Sakana AI与AtCoder合作构建ALE - Bench,设计ALE - Agent参赛成绩优异,不过它也有调试难等局限,未来待改进。
破解「长程智能体」RL训练难题,腾讯提出RLVMR框架,让7B模型「思考」比肩GPT-4o
腾讯混元AI数字人团队提出RLVMR框架,将‘元认知’理论引入RL,通过奖励‘好的思考过程’解决长程任务中智能体的低效探索与泛化难题,经其训练的7B模型表现出色。
LLM记忆管理终于不用“手把手教”了,新框架让智能体自主管理记忆系统
加州大学圣地亚哥分校和斯坦福大学研究人员提出强化学习框架Mem-α,用于训练LLM智能体自主管理记忆系统。它将记忆构建转为序列决策问题,采用多维度奖励函数,实验显示其全面超越现有方法。