「知识推理分离」共找到 2510 篇相关文章
自搜索强化学习SSRL:Agentic RL的Sim2Real时刻
本文由多机构联合完成,引入自搜索强化学习SSRL。它利用结构化prompt和format reward提取模型world knowledge,降低幻觉。还探索Sim2Real有效性,验证SSRL训练模型在真实场景泛化性,且所有训练数据等已开源。
斯坦福发布预警信号:生成式AI正如何重塑就业市场?年轻职场新人首当其冲
斯坦福大学Erik Brynjolfsson教授领衔的论文,用海量高频薪资数据研究AI就业效应。发现高AI暴露职业中年轻职场新人就业显著下降,自动化型AI应用致就业降,增强型则无,还给出年轻人受影响大的原因。
首个3D动作游戏专用VLA模型,打黑神话&只狼超越人类玩家 | ICCV 2025
淘天集团未来生活实验室团队提出首个3D动作游戏专用VLA模型CombatVLA,已被ICCV 2025接收。它能处理视觉输入输出动作指令,在战斗理解准确率和执行速度上表现优异,还构建了评测基准等。
笑死,人形机器人运动会全是鬼畜名场面!这锅粥大家来趁乱喝了吧
首届人形机器人运动会在国家速滑馆举行,现场状况频出,如机器人撞人逃逸、摔倒、抢球混战等。比赛项目多样,包括足球、拳击等。解说重点是AI知识,比赛规则也为机器人量身定制。
OpenAI首席科学家访谈被紧急制止!有些名字现在不让说了……
OpenAI首席科学家访谈时被要求禁止透露重要员工名字,因Meta常挖人。GPT - 5将发布,奥特曼谨慎应对。此外,还介绍了OpenAI研究方向、瓶颈,以及其他公司在挖人大战中的举措。
Meta华人新秀毕树超,重磅爆料下一代LLM路线!RL+预训练直通AGI
OpenAI前研究员、Meta成员毕树超在哥大演讲指出,AGI需高质数据、好奇驱动探索与高效算法,Scaling Law有效,规模决定智能,终身学习是重点,还探讨了AGI面临的诸多问题与挑战。
与三位前沿研究者聊AI Agent:规则、环境与热潮下的真问题|五源小酒馆Vol.31
五源小酒馆对话三位AI Agent前沿研究者,探讨其发展进展、挑战。他们分享对Agent定义、能力边界判断等,提及过去技术突破,如DeepSeek工作,也指出通用Agent瓶颈,探讨未来模型能否提有价值问题等。
忘掉《Her》吧,《记忆碎片》才是 LLM Agent 的必修课
文章把电影《记忆碎片》主角莱纳德看作真人版 Agent,结合情节拆解 Agent 上下文工程知识。阐述 Agent 取代 Chatbot 成行业主流,借莱纳德记忆系统说明上下文工程支柱,还指出 Agent 设计漏洞及需反思模块。
Claude Code + GLM-4.5,最强性价比编程组合教程首发
7月国产开源大模型竞争激烈,智谱发布的GLM - 4.5刷新开源大模型编程和agent能力。它成本低、速度快,还能与Claude Code配合。文章介绍该模型特点,分享二者使用教程及原型设计、网站开发等实测案例。
AI教父辛顿上海WAIC主题演讲:LLM真的理解语言,数字智能极其危险,可以无限复制
AI教父杰弗里·辛顿在WAIC开幕式演讲,对AI发展警惕且悲观。他认为LLM真理解语言,数字智能与生物智能差异大,AI进化快很危险,人类应全球合作研究让AI向善。