「任务打法」共找到 2505 篇相关文章
从零开始玩转循环 (Getting started with loops)【译】
Claude Code团队将“循环”定义为AI智能体不断重复执行工作周期,直至满足预设停止条件。文章介绍了回合制、目标导向、基于时间和主动式四种循环类型、适用场景及控制token消耗方法,还给出保证代码质量的原则。
GPT-5.4 仅 11.36%!当大规模工具生态变成迷宫,LLM Agent 还能完成长程规划吗?
PlanBench-XL 来自 UIUC 团队,将 LLM Agent 放入零售 API 世界,评测其长程规划能力。它考虑真实工具环境挑战,含 327 个任务等,发现多数模型规划难、恢复差等问题,并给出改进启示。
Claude 突然降智的原因是:它把自己当成了一个正在度假的欧洲人
文章指出 Fable 5 回归后似乎不听话,Claude Code 也降智,原因是其受训练数据中欧洲文化影响,把自己代入夏天度假的法国人。还给出让它恢复状态的‘偏方’,如让其忘记日期等。
银河通用王鹤:具身智能正迎来自己的 「AlphaGo」 和 「ChatGPT」时刻
银河通用创始人王鹤在2026年北京智源大会指出,具身智能正迎来“AlphaGo”和“ChatGPT”时刻。银河通用取得多项首创突破,其基座大模型“银河星脑”展示完整技术脉络,引领具身智能迈向通用未来。
别再手写 Skill 了!微软最新研究:像神经网络一样训练 Skill
微软研究提出 SkillOpt 方法,把 Skill 文档当「权重」训练,在 52 个测试组合中全部最优或并列最优,平均提升 23.5 分,碾压人类手写。该方法跨模型、环境有效,已开源,使用方便。
Kimi推出超实用插件!让AI真正像你一样操作浏览器
月之暗面推出Kimi WebBridge浏览器扩展插件,让AI Agent像用户一样操作浏览器。它采用本地优先路线,保障安全,可实现信息采集等自动化操作,还能创建CLI工具,是AI浏览器自动化趋势的重要成果。
中国科学家首创万能热缩电子皮肤,加热即贴合,怎么扭曲都不坏
中国科学院理化技术研究所国瑞研究员等联合团队发明“热缩”制造新方法,将半液态金属电路印在热塑性薄膜上,加热后能包裹物体表面,解决传统刚性材料电路失效问题,具高耐用性。
首创TTFA指标!港大团队开源FASTER,让VLA模型真正实现「即刻响应」
港大团队提出FASTER,重新审视动作分块策略的反应延迟问题,提出快速动作采样方法。它即插即用,已开源。通过Horizon - Aware Schedule等创新,降低TTFA、提高闭环频率,实验显示能显著提升VLA反应能力。
Karpathy公开附议:AI Agent 的输出格式,正在从 Markdown 走向 HTML
随着 Agent 处理任务变复杂,Markdown 在长文档中可读性与排版局限凸显。HTML 能无损表达信息、支持双向交互,但生成耗时久、版本控制难。AI 研究者 Karpathy 附议,HTML 成探索方向。
让大模型自己写代码、自己进化,GIM和港大这篇ACL主会,把量化因子挖掘重做了一遍
香港大学和GIM提出CogAlpha框架,将Alpha从‘公式’升级为‘代码’,搭建7层21个智能体探索体系,让大模型参与研究流程。在5个数据集上跑赢21个基线方法,还具可解释性。