「语言驱动」共找到 1663 篇相关文章
告别「利用率崩溃」:GIPO开启大模型强化学习高效训练新方法 | ICML 2026
树根科技与三一集团团队联合提出 GIPO 算法,在机器人操控及大语言/视觉动作模型强化学习训练中,缓解了策略滞后痛点,改善了 PPO 硬截断引发的‘利用率崩溃’问题。介绍了 GIPO 算法原理、优势及实验结果。
把 RAG 做成主流的公司,现在开始“做空”RAG 了
Pinecone 曾将 RAG 定义成大语言模型 grounding 标准范式,如今却宣布 RAG 时代结束。它推出面向 Agent 的知识引擎 Nexus,提出“知识编译”概念,称能提高任务完成率、降低 token 开销,整个 AI 世界都在将“推理”往上游移动。
亚马逊云科技 AI 助手终于来了,一出手就对标 Cowork
亚马逊云科技推出 AI 助手 Amazon Quick,对标 Claude Cowork。它是 AI 驱动的桌面办公助手,可通过自然语言完成多项办公任务,还能连接多种办公工具,在国内使用体验好,体现了 AI 办公从‘工具增强’走向‘流程重构’。
地瓜机器人携手虚时科技,补上具身智能的仿真数据“黑洞”|甲子光年
5月12日,虚时科技与地瓜机器人联合开发的AnySceneGen平台发布,这是面向具身智能训练的仿真空间生成平台。具身智能训练需海量数据,传统仿真数据生产依赖人工,效率低。该平台以模型替代人工,重构生产方式,优势显著。
设计圈的 Claude Code 时刻来了
Anthropic发布Claude Design,震惊程度堪比当年Claude Code。它由Claude Opus 4.7驱动,界面简单,与传统设计工具不同,AI为主生成者,人为主审阅者。能覆盖多类工作,对各角色影响大,虽有局限但未来可期。
AI数据工程师在应用中如何"返璞归真"
文章反思‘知识库+Prompt工程+工具调用’轻量级Agent构建模式局限,指出其难应对知识质量、语义理解与规模化维护挑战。提出从‘Prompt驱动’到‘上下文工程’、从‘搭积木组装’到‘全链路闭环’的范式跃迁,并介绍MktAI知识体系建设。
让外部知识“长入”模型:动态化与参数化 RAG 技术探索
检索增强生成(RAG)成大语言模型利用外部知识主流范式,但传统方法将其当黑箱,忽略动态需求和机制鸿沟。艾清遥博士介绍动态化和参数化检索增强技术,可提升准确性与适应性,减少计算开销。
自回归因果注意力也能并行解码?上交联合UCSD突破LLM推理瓶颈,模型代码全开源
大语言模型推理速度是应用瓶颈,传统方法各有弊端。上交和UCSD团队提出Jacobi Forcing方案,无需重构架构,将AR模型转为并行解码器,提速显著且质量损失小,核心优势多,技术路线全链路优化,实测表现优。
AI原生数据库的思考
文章围绕AI原生数据库展开,分析企业应用大模型的问题,指出AI场景驱动数据库新工作负载。探讨AI数据库变与不变、实现路径,介绍原生混合搜索、现代数据架构、数模融合等,还提及seekdb的发布、定位、优势与不足。
NeurIPS 2025 Spotlight | 选择性知识蒸馏精准过滤:推测解码加速器AdaSPEC来了
大型语言模型推理延迟高、开销大,推测解码可加速但依赖草稿与主模型一致性。佐治亚理工等团队提出 AdaSPEC 蒸馏法,过滤难学 token,提升草稿模型与目标模型对齐度,实验显示能提升接受率和推理速度。