「三阶段训练」共找到 3260 篇相关文章
JCP | 南科大赵肃楠、王建春等:LESnets:基于物理信息神经算子的湍流大涡模拟
本研究提出基于物理信息神经算子的LESnets方法,用于快速模拟粗网格上三维湍流时空演化。不使用标签数据,训练两种神经算子,验证了其有效性和泛化能力,效率显著优于传统方法。
LSTM之父22年前构想将成真?一周内AI「自我进化」论文集中发布,新趋势涌现?
本文介绍AI模型自我进化方向的进展,涉及多机构的相关论文。如受“哥德尔机”启发的“达尔文哥德尔机”可自我改进;还有“自我奖励训练”“MM - UPT”“UI - Genie”等方法,展现AI自我进化潜力。
刚刚,DeepSeek首曝V3降成本秘诀!软硬协同突破Scaling天花板
DeepSeek最新论文从硬件架构和模型设计双重视角,探讨如何相互配合实现低成本大规模训练和推理,分析硬件特性对架构选择的影响,研究两者相互依赖关系,还为未来协同设计提出建议。
56亿颗芯片撑起230亿市值!北交所芯片第一股今日上市
8月12日杰理科技于北交所上市,成“芯片设计第一股”。其以蓝牙音频为基本盘,产品进众多品牌供应链。2023 - 2025年营收有波动,业绩在2025年回落。募资投向三大项目,后续表现待察。
人形之外,擎羽把“身体”变成具身智能的新变量
机器人身体正成为具身智能里被低估的变量。擎羽科技不走人形路线,带来三款仿生柔性机器人及跨本体基础模型Fi0,提出柔性具身智能概念,让智能摆脱对单一身体的依赖。
为什么今天造大模型的人,一半在学物理
文章指出在AI前沿,不少定义方向的人出身物理。物理训练赋予的品味与做AI的方法论高度重合,体现在统计力学与神经网络、对普适规律的信仰等方面,还提到Scaling Laws最能体现这种品味。
手撕、翻滚、暴力砸地!最「扛造」的灵巧手来了
4月17日智元合作伙伴大会上,临界点AGILINK发布三款新品,包括旗舰级工业绳驱灵巧手OmniHand 3 Ultra - T、普惠型耐造小手OmniHand 3 Lite和全面焕新的具身夹爪OmniPicker 3,各有优势且兼顾量产与开源。
OpenAI突然封锁最强GPT-5.4!3000个致命Bug瞬间蒸发
OpenAI在Claude Mythos泄露一周后,祭出专门为安全防御微调的GPT-5.4-Cyber,仅网络安全专家可用。还升级网络安全“信赖访问计划”。其战略有三原则,Codex Security已修好超3000个高危和致命漏洞。
蚂蚁集团扩散大语言模型新突破:超800Token/s,速度与质量兼得
蚂蚁集团将LLaDA更新到2.1,通过引入“草稿 - 编辑”机制,打破扩散模型推理速度与质量的对立僵局。它有极速和质量两种模式,还采用混合训练流程及强化学习,在多基准测试中表现出色。
蚂蚁具身智能明牌了:做大脑,和宇树们错位竞争
蚂蚁灵波开源具身智能基座模型LingBot-VLA,用20000小时真实世界数据训练,解锁最大规模开源真机数据之一。它性能超国际顶尖模型,还指明通用具身智能发展路径,为行业提供全栈解决方案。