「赋能增值」共找到 5082 篇相关文章
超实用提示词模板!AI科学家教你用协作提示词激发大模型潜力
文章由知名AI科学家Lance Eliot所写,指出主流大语言模型因训练机制变得‘短视’,缺乏深度协作能力。介绍协作提示词技术,能让AI成为主动引导者,并以测试展示效果,还说明了适用场景。
只演示一次,机器人就会干活了?北大&BeingBeyond联合团队用“分层小脑+仿真分身”让G1零样本上岗
北大与BeingBeyond团队提出DemoHLM框架,仅需1次仿真演示就能生成海量训练数据,解决人形机器人移动操作数据效率低、任务泛化差、Sim-to-Real迁移难的问题,在仿真和真实机器人上验证效果良好。
GRPO训练不再「自嗨」!快手可灵 x 中山大学推出「GRPO卫兵」,显著缓解视觉生成过优化
GRPO在视觉生成流模型后训练阶段有显著提升,但clip机制存在系统性偏差,易使模型陷入过度优化。中山大学、快手可灵等团队提出GRPO - Guard,能降低过度优化风险,在多种任务中表现良好。
模型即智能体,Kimi K2 Thinking多项评估超越顶尖闭源模型,300轮工具调用不疲倦
月之暗面发布Kimi K2 Thinking,它是Kimi迄今最强开源思考模型,基于模型即智能体理念训练,可自主连续工具调用与多轮思考,多项评估超顶尖闭源模型,还实现原生INT4量化,提升生成速度。
强化学习+大模型记忆:Mem-α,让智能体第一次学会“如何记忆”
在大语言模型发展中,‘记忆’是智能体具备长期智能的关键。现有外部记忆系统有局限,Mem-α将强化学习引入大模型记忆管理体系,解决记忆难题,在性能、泛化等多方面表现出色。
谷歌Gemini闹乌龙:我家狗子,竟被AI开除了「狗籍」!
2025年10月谷歌让Gemini for Home接管智能家居生态。它能识别人脸、快递等,还会生成家庭日报。不过,它也闹了把狗认成猫的乌龙。谷歌正改进识别准确度,这也是智能家居竞争中的小插曲。
北大字节开源首个时空推理视频模型!思考过程全透明,性能超越GPT-4o
北大和字节联合团队推出开源模型Open-o3 Video,将显式时空证据嵌入视频推理全过程,采用non-agent架构,性能超越GPT - 4o等闭源模型。该模型构建了STGR语料体系,采用双阶段训练,实验表现优秀。
别再只关注KV Cache了! LLM稀疏性新洞察:为何模型越深越稀疏?UNCOMP从矩阵熵给出答案
团队论文UNCOMP获EMNLP 2025主会接收,它提出高效推理框架,从截断矩阵熵视角解释LLM深层稀疏现象。还能识别关键结构、找到最优压缩策略,设计的UNCOMP框架优化KV Cache,实验效果佳。
单张4090跑到30fps,范浩强团队让VLA实时跑起来了
Dexmal原力灵机团队在RT - VLA论文中公布,常用Pi0级30亿参数VLA模型在单张RTX 4090上最快能跑30fps。他们深入分析优化模型,成果已开源,还设计了未来控制框架。
让机器人在“想象”中学习世界的模型来了!PI联创课题组&清华陈建宇团队联合出品
斯坦福Chelsea Finn课题组与清华陈建宇团队联合提出可控生成世界模型Ctrl - World,可让机器人在“想象空间”预演任务。该模型使用零真机数据,提升下游任务指令跟随成功率。其相关论文已发布于arXiv平台。