「自适应算力」共找到 1871 篇相关文章
极简RL新范式:一半算力刷新1.5B模型推理SOTA
过去为提升中小参数量模型推理能力,开发者构建复杂RL流水线。JustRL论文提出极简、单阶段、固定超参训练方案,在两主流1.5B模型上刷新SOTA,节省2倍算力,消融实验还揭示部分技巧会致性能退化。
首篇以第一性原理剖析OpenClaw自进化AI社会的论文
截止发文,OpenClaw项目已达192k Star,其衍生的AI Agents社会网络moltbook聚集大量智能体。北邮等团队首次从第一性原理研究,提出“自进化不可能三角”理论,还给出缓解策略。
陶哲轩痛诉很缺钱!科研经费暴跌67%十年最低,自掏腰包科研
美国国家科学基金会削减基础科学资助,数学科学领域资助大降。菲尔兹奖得主陶哲轩痛诉经费不足,自掏腰包做科研,还以“开普勒的橙子”说明基础研究虽短期无用,却能助力科技突破。
可塑的计算机Omarchy爆火硅谷,龙虾之父自掏100万投资
Ruby on Rails 作者 DHH 推出 Linux 发行版 Omarchy,将 AI agent 嵌进系统底层,有独特设计和功能。自带安装脚本,安装快。获十位大佬各 100 万美元赞助,多家系统也在探索 AI 嵌入,它有望开启 Agent OS 时代。
震撼,马斯克联手老黄扔出星际大脑!AI算力中心射上天
SpaceX财报公布,携手英伟达推出轨道AI计算网络Starmind,将AI算力底座搬至太空,解决耗电与散热问题,还介绍了其卫星、优势及马斯克建造太空AI大脑的计划和野心。
从 ReasoningBank 到 MetaAgent,RL 未必是 Agent 自进化的必要解?
业内对智能体自进化的探讨开启多路线探索模式。除 RL 优化,记忆系统改进成新方向,如 ReasoningBank 机制。此外,业内还从智能体自我识别、工具和策略辅助等机制探索其他技术路线。
VLA统一架构新突破:自回归世界模型引领具身智能
北京智源研究院联合中科院自动化所提出 UniVLA 全新 VLA 模型架构,基于全离散、自回归机制建模多模态信号,后训练引入世界模型。它刷新多项基准纪录,在真机操控和自动驾驶有潜力,为多模态感知决策融合带来新思路。
华人团队终结Token危机:扩散模型数据潜力超自回归三倍
最新研究发现,token数量受限下,扩散语言模型数据潜力超自回归模型三倍多。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。
连续自回归的dots.tts:小红书开源语音合成模型「基座」
语音合成赛道发展如早期大语言模型,路线未收敛。小红书与上海交通大学合作开源的 dots.tts,是 20 亿参数、全连续、端到端自回归 TTS 基础模型,有准确度高、可扩展等特点,还开源了代码。
Self-Forcing++:让自回归视频生成模型突破 4 分钟时长极限
加州大学洛杉矶分校与字节Seed等团队联合完成Self-Forcing++,让自回归视频生成模型突破4分钟时长极限。它解决传统模型架构缺陷,经三步技术实现稳定超长视频生成,实验超基线,但仍有长时记忆缺失等问题。