元认知复用机制」共找到 1256 篇相关文章

产品应用8

将导游装在口袋里:AI 对景区游览新赋能

同程旅行研发的“同程伴游”AI助理,能为景区游客答疑解惑,实现原生数字化导览。它可按需讲解、避免走回头路,还能生成数字旅行日记。其基于高精度定位和大语言模型,未来还将持续升级。

AI前线
算法论文8

GRPO训练不再「自嗨」!快手可灵 x 中山大学推出「GRPO卫兵」,显著缓解视觉生成过优化

GRPO在视觉生成流模型后训练阶段有显著提升,但clip机制存在系统性偏差,易使模型陷入过度优化。中山大学、快手可灵等团队提出GRPO - Guard,能降低过度优化风险,在多种任务中表现良好。

机器之心
算法论文8

解决Agent幻觉:HaluMem精准定位记忆系统的“说谎”环节!

近年来,LLM和Agent在记忆管理上存在挑战,现有评估方法无法定位幻觉来源。论文提出HaluMem评估基准,通过三大任务和两个数据集揭示记忆系统幻觉行为,为开发可靠记忆机制提供指导。

深度学习自然语言处理
开源动态8

北大字节开源首个时空推理视频模型!思考过程全透明,性能超越GPT-4o

北大和字节联合团队推出开源模型Open-o3 Video,将显式时空证据嵌入视频推理全过程,采用non-agent架构,性能超越GPT - 4o等闭源模型。该模型构建了STGR语料体系,采用双阶段训练,实验表现优秀。

量子位
推荐文章8

《AI大模型时代老板必修课》

阿里云蒋林泉与钛媒体刘湘明在云栖大会展开《AI大模型时代老板必修课》对谈,围绕企业AI落地多方面关键议题交流。探讨了CIO角色进化、AI业务价值界定、企业战略制定等内容,为决策者提供实践指南。

阿里云开发者
产品应用7

C3仓库AI代码门禁通用实践:基于Qwen3-Coder+RAG的代码评审

本文介绍C3仓库基于Qwen3 - Coder+RAG的代码评审实践,在CI流水线监听代码修改触发AI评审,可发现逻辑风险、拦截高危缺陷。该实践能提升评审效率与质量,可复用于代码门禁平台或辅助编程工具,当前仍在持续优化。

阿里云开发者
产品应用7

优步凭借 CacheFront 的改进实现每秒 1.5 亿次的读取操作

优步工程师更新 CacheFront 架构,实现每秒 1.5 亿次读取操作且确保强一致性。解决了旧设计中陈旧数据读取问题,引入新协议和机制,弃用专用 API,还增强监控工具,提高缓存命中率。

InfoQ
算法论文7

BesiegeField:LLM能否学会设计机器?

香港中文大学推出基于游戏《Besiege》的测试平台BesiegeField,探讨LLM能否学会设计机器。研究通过组合式机器设计视角,测试LLM,提出多智能体迭代设计流程等,发现LLM有挑战但并非不可实现,如Gemini 2.5 Pro表现不错。

带你学AI
算法论文8

谷歌揭秘:Multi-Agent 推理时扩展才是未来。

谷歌DeepMind和MIT联合发表论文TUMIX,指出Multi - Agent是推理时扩展的最佳方式,以低成本大幅提升准确率。实验表明Agent多样性优于重复采样,还展示TUMIX机制、实战表现,且LLM能设计更强Agent。

探索AGI
推荐文章7

AI 产品范式探讨:非线性思维、多 Agent 协作才是复杂任务的更优解

本文探讨AI产品范式,指出当前大模型产品设计多将其视为‘万能单兵专家’,但复杂任务下效果不佳。提出群体智能、非线性思维等观点,阐述人机协作方向,介绍新范式及AI产品商业化核心是信任。

Founder Park