大模型Agent」共找到 10524 篇相关文章

新闻资讯7

苹果拆解AI脑,推理模型全是「装」的?Bengio兄弟合著

苹果最新研究揭示推理模型(LRM)在高复杂度任务中普遍‘推理崩溃’。即便给予明确算法提示,模型亦无法稳定执行,暴露推理机制的局限性。研究还通过多种实验环境分析了模型在不同复杂度问题中的表现。

新智元
推荐文章7

Agent经济,要来了

红杉资本半小时演讲讲清AI产业现状与趋势。介绍了分析框架,指出AI浪潮且猛,会颠覆软件市场,机会在应用层。还提出Agent经济概念,建议家抓住机会行动起来。

newtype AI
算法论文8

Think in Games:做一个在王者荣耀中会玩和思考的Agent

文章介绍论文《Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models》,指出当前AI在游戏领域面临的困境,提出TiG框架结合语言模型与强化学习,打造既会做又会说的AI,实验验证其高效性。

深度学习自然语言处理
新闻资讯7

2025 AI Agent 发展现状与六趋势

近半年,Agentic AI 创新加快,推动产品落地与商业化。2025 年市场格局显现,有 Agentic RAG、Voice Agents 等六关键趋势,各有定义和应用场景,不少公司已采用相关技术。

特工宇宙
算法论文7

AI在「赚钱锦标赛」夺冠,比人类还会做生意!躺赚时代要来了?

研究人员提出自动售货机运营模拟环境Vending - Bench,测试模型智能体管理业务能力。实验显示不同模型性能方差,Claude 3.5 Sonnet净资产表现最佳,人类基线在可靠性上表现较好,各模型长周期表现波动

新智元
新闻资讯8

@所有开发者:Agent变现,阿里云百炼联合支付宝首创「AI打赏」!Agent Store全新发布

2025年是Agent元年,不过很多项目卡在POC阶段。6月25日阿里云百炼3.0全新升级,联合支付宝推“Agent打赏”功能,还上线Agent Store。此外,它升级多模态RAG和MCP能力,推出多模态交互开发套件。

量子位
新闻资讯8

4位图灵奖得主布道,2冠军机器人登台,“AI春晚”果然又高又硬

智源会堪称“AI春晚”,规格高看点多。4位图灵奖得主分享观点,长跑冠军天工和拳击冠军宇树G1机器人秀技能。会还发布“悟界”系列模型,RoboOS 2.0与RoboBrain 2.0开源,多方探讨下一代AI发展路径。

量子位
新闻资讯7

Altman 秀新模型“翻车”,谷歌补刀躺赢!OpenAI 前员工爆肝 3 天,编程再赢老东家模型

近期,OpenAI 携多款未公开新模型亮相。在 IMO 竞赛中,其宣称新模型获金牌,谷歌 DeepMind 的 Gemini Deep Think 也达金牌水平,但网友对二者评价不一。此外,‘o3 Alpha’疑上线,前 OpenAI 员工还在编程赛中击败 OpenAI 模型

InfoQ
开源动态8

Anthropic开源认知对齐MSM

模型对齐、安全问题是行业事,Anthropic开源的MSM对齐方法,能将Qwen3 - 32B的agent错位率幅降低。它先给模型讲规则逻辑再微调,控制精度高,还研究了最佳实践,将改变模型对齐流程。

CourseAI
新闻资讯7

阿里巴巴模型品牌统一为千问

今天,阿里巴巴AI总称和核心品牌统一为千问,涵盖基础与专业领域模型,千问APP是C端旗舰应用。今年除夕开源千问3.5,多款中小型模型上榜,春节用户下单近2亿次,DAU增成国民级助手。

千问Qwen