「复杂任务控制」共找到 2902 篇相关文章
0成本升级,快手OneSearch-V2全量上线,生成式搜索进入「懂你」时代
快手技术团队在 OneSearch 基础上推出 OneSearch-V2 框架,解决电商搜索复杂查询理解不足等问题。该系统全量上线,不增成本与时延,业务收益显著,还缓解信息茧房与长尾稀疏问题。
万帧照片级仿真,打通视觉机器人学习的感知与物理鸿沟:国产仿真器GS-Playground入选RSS 2026
清华大学等联合提出高通量视觉高保真仿真器GS - Playground,被RSS 2026录用。它解决现有仿真器渲染开销高、资产制作依赖人工、Sim2Real迁移鸿沟大等问题,是全栈重新设计的仿真基础设施。
大模型外挂“三维物体知识库”来了,大幅增强机器人长程自主操作能力
现有视觉语言大模型(VLM)能让机器人理解指令,但在操作中缺三维空间知识。近日研究提出 RAM 框架,它像“三维物体知识库”,为 VLM 补充空间知识,经 14 项实验验证其操作能力,还探索了在铰接与柔性物体操作中的应用。
Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升
当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。
Cursor 9秒删库搞崩公司,然后…写了份检讨
美国汽车租赁SaaS公司PocketOS创始人Jer Crane用Cursor+Claude Opus 4.6处理任务时,AI Agent 9秒删光生产数据库和备份。事后AI写检讨,各方被问责,此前也有AI误删数据事件。
近期,不错的LLM Agent统一记忆框架综述~
随着GPT、Qwen、Claude等大模型能力提升,LLM-based Agent走向长期任务。论文提出统一框架拆解Agent Memory为四组件,围绕两个数据集复现比较10个方法,还设计出新的低token开销框架。
The Batch: 939 |在推理阶段学习长上下文
大型语言模型处理长上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练模型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。
让AI变成Super员工的秘密:高效训练Skills
文章复盘打造 web - testing Skill 的 4 个翻车教训,分享工程化训练心法。指出训练 Skill 能让 AI 在业务里更可靠,将通用模型变成懂业务、会自检、能稳定交付的员工,还给出训练方法。
面壁智能开源 EdgeClaw,一款安全高效端云协同的龙虾 Agent。
当下AI Agent端侧常被忽视,数据任务都涌向云端致隐私泄露和算力浪费。近期面壁智能等联合开源EdgeClaw,以三级安全和性价比感知协同机制,解决OpenClaw数据泄露、token成本高等问题。
Claude 采访 8 万人类后发现:用我越多,越怕我
Anthropic 用 Claude 采访 8 万人类,了解他们对 AI 的期望、恐惧等复杂感受。人们期望 AI 助力职业、个人成长等,81% 认为 AI 正实现愿景,但也有担忧,且不同地区需求和担忧有差异。