「运行时」共找到 1163 篇相关文章
CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」
新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略。
终于用上啦,3.9 万 Star archify,程序员福音!!!!
架构图常与代码脱节,约3.9万Star的archify让Agent先把代码库或系统描述写成带类型的JSON,经布局、检查后交付可交互系统地图,它先结构化、验证再交付,适用于特定场景。
长程 Agent 越跑越乱?ContextPilot 用细粒度 RL 教会模型主动管理上下文
长程 Agent 推理时,传统方法使上下文臃肿、推理成本高。清华、腾讯等团队提出 ContextPilot 框架,扩展管理工具集、采用新采样和信用分配方法。实验显示其用短上下文获高分,降低推理开销。
鹿明发布NexCore:当机器人技能成为一种基础设施
8月19日鹿明机器人发布具身智能进化引擎Lumos NexCore,试图在数据、模型等与机器人间建立生产与运行链路,让机器人能力成可复用‘技能资产’,解决具身智能技能生产效率问题。
你觉得 Kimi K3 又慢又贵是吧,我来告诉你为什么
作者用 Kimi K3 为墨问的 CatReader 增加发现页,实操中它多数时候快且抗用,不过周五晚变慢,收尾工作交给了 GLM 5.2。对用户觉得 K3 又慢又贵的问题进行分析,还区分了 Kimi App 和 Kimi Code 使用场景。
世界模型的新用途:不做选手,去当裁判
眼下具身赛道都在抢着做机器人的“大脑”,而地瓜机器人发布的世界模型Uranus却剑走偏锋,做机器人开发的基础设施。它能更客观地评测VLA和世界模型,还能做机器人训练的“场地”。
Agent 狂欢热潮下的冷思考:为什么规模化落地总是陷入僵局?
Agent热潮下企业规模化落地遇阻,因其与传统AI应用不同,面临弹性、运维和治理挑战。腾讯云Agent Runtime围绕Agent生命周期构建基础设施,覆盖两大核心场景,已获批量验证。
第九章 编码 Agent 实战——用 Deep Agents 构建代码审查助手
文章介绍用 `deepagents` 框架构建代码审查 Agent 的实战项目。此框架封装重复工作,让开发者专注业务逻辑。文中讲解其安装、最小运行示例,还介绍自定义工具及添加审查标准技能的方法。
Cursor 终于让你可以关笔记本了
昨夜,AI编程工具Cursor发布Agent云功能更新,解决本地运行占资源问题。可本地云端无缝切换,10分钟搭云端开发环境,有独立云子Agent隔离任务,iOS测试版上线,获用户认可。
ICML 2026 | Agentic强化学习训练的信息自锁问题
随着大语言模型走向真实交互,强化学习训练LLM agents时出现信息自锁问题。香港中文大学等研究者分析其原因并提出AREW方法,在多场景实验中表现稳定且具鲁棒性。