「自注意力机制」共找到 1944 篇相关文章
首次!世界模型、动作模型融合,全自回归模型WorldVLA来了
阿里巴巴达摩院提出全自回归模型 WorldVLA,首次融合世界模型与动作模型,统一文本、图片、动作理解和生成。它用独立编码器处理多模态数据,还提出策略解决误差累积问题,实验表现优异。
首篇以第一性原理剖析OpenClaw自进化AI社会的论文
截止发文,OpenClaw项目已达192k Star,其衍生的AI Agents社会网络moltbook聚集大量智能体。北邮等团队首次从第一性原理研究,提出“自进化不可能三角”理论,还给出缓解策略。
陶哲轩痛诉很缺钱!科研经费暴跌67%十年最低,自掏腰包科研
美国国家科学基金会削减基础科学资助,数学科学领域资助大降。菲尔兹奖得主陶哲轩痛诉经费不足,自掏腰包做科研,还以“开普勒的橙子”说明基础研究虽短期无用,却能助力科技突破。
任务自适应 Harness:从 Trace 到多 Coding Agent 的协作记忆
作者为AI Coding准备的端到端方案未落地,后在Routa项目找到新落点。基于ACP协议的Agent Trace可记录关键行为,用于分析优化。还介绍了Feature Explorer、Kanban Harness及任务自适应Harness,探讨多Agent协作记忆。
挖掘注意力中的运动线索:无需训练,解锁4D场景重建能力
香港科技大学(广州)与地平线团队提出VGGT4D,通过分析VGGT内部机制,利用注意力层运动线索,提出无需训练框架,在动态物体分割等任务表现优异,为低成本4D重建提供新思路。
华人团队终结Token危机:扩散模型数据潜力超自回归三倍
最新研究发现,token数量受限下,扩散语言模型数据潜力超自回归模型三倍多。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。
GPT-5点赞!八大顶尖机构发布「自进化智能体」全面综述
在2025年,大语言模型已演变为智能体,但现有智能体部署后难以适应变化。格拉斯哥大学等机构学者发布综述,系统梳理自进化AI智能体核心框架与挑战,提出三定律,还介绍了优化技术、应用案例等,并指出未来方向。
连续自回归的dots.tts:小红书开源语音合成模型「基座」
语音合成赛道发展如早期大语言模型,路线未收敛。小红书与上海交通大学合作开源的 dots.tts,是 20 亿参数、全连续、端到端自回归 TTS 基础模型,有准确度高、可扩展等特点,还开源了代码。
Self-Forcing++:让自回归视频生成模型突破 4 分钟时长极限
加州大学洛杉矶分校与字节Seed等团队联合完成Self-Forcing++,让自回归视频生成模型突破4分钟时长极限。它解决传统模型架构缺陷,经三步技术实现稳定超长视频生成,实验超基线,但仍有长时记忆缺失等问题。
借鉴人脑「海马体-皮层」机制,红熊AI重做了一个「记忆系统」
记忆成AI进化关键,Google Research新论文提出「嵌套学习」范式。红熊AI受业务难题启发,推出「记忆熊」,借鉴人脑机制重构记忆系统,在多场景应用落地,提升了服务质量和效率。