「LLM-Agent」共找到 3432 篇相关文章
LLM算力告急?把文本变图片,推理成本直接减半!
大型语言模型处理长文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将长文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。
强化学习之父Richard Sutton最新采访:LLM是“死路一条”
强化学习之父Richard Sutton在采访中批判当前由LLMs主导的AI发展路径,认为其是死胡同,缺乏真实世界模型与目标。他构想‘经验时代’新范式,预言权力向更高级智能转移,也指出未来面临腐败与价值观挑战。
Reasoning新突破:SoftCoT++如何让LLM‘多想几条路’?
LLM推理依赖‘思维链’,传统方法在离散token空间生成步骤有信息丢失、多样性不足问题。SoftCoT++在连续空间生成‘软思维’,拆分‘思考’与‘推理’,用专用初始token和对比学习,实验中全面超越传统方法。
AI编码不是梦:手把手教你指挥Agent开发需求
文章聚焦AI实践应用,以后端开发为例,介绍用AI编码实现需求的流程,涵盖工程结构、各层代码生成等。还分析AI编程问题,提出解决方案,给出生产案例,最后展望AI在研发中的应用前景。
OpenClaw 走红背后:Agent、AI Coding 与团队协作的新问题
InfoQ《极客有约》X QCon 直播栏目邀请专家探讨 OpenClaw 爆火背后的问题,如 Agent 能否进入研发流程、AI 写代码边界等。专家认为 OpenClaw 并非低门槛产品,AI Coding 需解决可控问题,团队落地要平衡 SPEC 和 Vibe 模式。
Agent群体智能来了!魔搭开源Agent自进化群体智能框架:群体记忆自动蒸馏与进化,8万+群体技能即取即用,智能体画像一键复用
个人或团队部署使用智能体面临状态易失、重复试错、迁移困难等痛点。魔搭ModelScope团队开源的Ultron框架,补上群体协作基础设施,解决经验沉淀、技能进化和画像共享问题,提升智能体协作效率。
用超图撕开知识边界:16万节点无师自通搞Agentic科研
传统知识图谱只能用三元组描述世界,难以应对真实科学场景里的多体交互。作者提出将文献里n元关系存成超图超边,让LLM在多智能体框架里‘沿着超边走路’,并构建了超图进行实验,实现可验证的科学发现。
Snowflake CEO 复盘:为什么 LLM 时代企业需要一个 AI Data Cloud?
Snowflake曾是企业数据平台代表,随AI崛起,CEO Sridhar推动其转型为AI Data Cloud。Snowflake Intelligence上线,不造基础模型,专注放大数据价值,其可靠、计费合理,核心竞争力在数据。
来自 Manus 的一手分享:如何构建 AI Agent 的上下文工程?
Manus 公司联合创始人季逸超分享为 Manus 搭建上下文工程的经验。文章探讨构建 AI 智能体时的关键抉择,给出围绕 KV - Cache 设计、通过掩码约束行为等构建原则,助开发者少走弯路。
Karpathy:我不是要造新词,是「上下文工程」对 Agent 来说太重要了
Andrej Karpathy 认同Shopify CEO关于「上下文工程」的观点。它指为大语言模型提供恰当信息和工具,比提示词工程更重要。文章介绍其概念、与提示词工程区别,及写入、筛选等落地策略。