「低精度训练」共找到 3113 篇相关文章
无需奖励函数!我们意外构建了自我进化的AI系统
牛津大学发现LLM可通过“部署 - 验证 - 再训练”循环自我进化,绕开人工奖励函数设计瓶颈。在三个经典规划领域实验效果惊人,还在理论上证明其与强化学习的数学等价关系,有优势也有隐患。
LeCun预言成真!790年长视频,炼出最强开源「世界模型」
2025年‘世界模型’成AI巨头战场,谷歌、李飞飞团队等纷纷布局。上周北京智源研究院发布Emu3.5,340亿参数,基于790年长视频数据训练,其架构优越,推理快,能力强,还公开技术报告邀全球探索。
清华万引教授:万倍加速催化剂设计,AI突破DFT瓶颈!
清华大学王笑楠团队提出催化剂设计新基础模型SurFF,发表于Nature Computational Science。它无需昂贵实验或耗时DFT计算,实现对金属间化合物表面暴露与形貌的高效、高精度预测,计算速度提升10⁵倍。
飞书让表格变成「AI同事」加入群聊,不打开表就能用表
6月23日,Anthropic发布Claude Tag,让Agent进入Team Agent时代。飞书多维表格新功能「多维表格智能体」上线,思路类似,能让Agent成团队同事。它补齐权限和长期记忆,低门槛、可信,能主动工作。
CMU&NYU最新工作解释:存储在权重里的“智能”是从哪来的?
论文《From Entropy to Epiplexity》指出经典信息论在AI面前有三大悖论,提出用Epiplexity度量信息。它将数据信息拆为Time - bounded Entropy和Epiplexity,通过神经网络训练近似计算,实验验证其有效性,并给出启示。
告别微调!腾讯提出Training-Free GRPO:无需更新参数,还能保证泛化性,成为传统RL的有力替代
大型语言模型在专业领域表现不佳,传统微调方法成本高、易过拟合。腾讯优图实验室提出Training - Free GRPO,无需更新参数,通过上下文学习提升性能,成本低且泛化性好,是传统强化学习有力替代。
AI真的需要「像人类」那样思考吗?AlphaOne揭示属于大模型的「思考之道」
近年大模型在推理任务有进展,但缺乏推理节奏调控能力。伊利诺伊大学厄巴纳 - 香槟分校和加州大学伯克利分校研究提出 AlphaOne 框架,引入 α - moment 实现无需训练的推理调控,实验显示其能提升准确率和效率。
AST| 西工大单湘淋、张伟伟等:基于湍流各向异性分析与符号回归的改进型二阶非线性涡粘模型
针对非线性涡粘模型各向异性建模难题,西工大单湘淋、张伟伟等通过雷诺应力各向异性分析方法开展特征提取,构建新型二阶非线性涡粘模型,在方形管道与矩形扩压器湍流测试中,精度优于现有模型。
阿里新研究:统一了VLA和世界模型
阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。
DDR4持续涨价,DDR5成为新的性比价之王?
近期DDR4价格持续上涨,其告别性价比,原因是存储巨头战略转移。而DDR5性能强、功耗低,实测表现优,价格也有优势,已成为新的“性价比之王”,替代DDR4是大势所趋。