预训练范式」共找到 2905 篇相关文章

算法论文8

上交、清华、微软、上海AI Lab等联合发布数据分析智能体综述,LLM化身数据分析师,让数据自己「说话」

传统数据分析方法耦合度高、扩展性差,大语言模型与智能体让数据分析迈向“语义理解”。上交、清华等机构联合撰写综述,回顾演进,提出新范式,总结关键技术、趋势及挑战,推动通用数据分析智能体发展。

机器之心
新闻资讯7

The Batch: 865 | 机器人外科医生的切割与夹闭

约翰·霍普金斯大学等团队开发Hierarchical Surgical Robot Transformer(SRT - H),结合两个transformer模型,通过模仿学习训练,用达芬奇机器人完成胆囊切除关键步骤。虽在体外组织测试表现好,但应对人体手术仍有挑战。

DeeplearningAI
算法论文8

监督学习也能从错误中学习反思?!清华英伟达联合提出隐式负向策略爆炸提升数学能力

清华大学与英伟达、斯坦福联合提出监督学习方案NFT,在RFT算法基础上构造“隐式负向模型”利用负向数据训练。该策略弥合监督与强化学习差距,其损失函数梯度和GRPO在On - Policy条件下等价。

量子位
产品应用8

都在问世界模型怎么落地,PixVerse把答案做成了「好玩」

互动式娱乐市场正在爆发,PixVerse推出实时视频世界模型R2版本。该版本让用户真正和世界交互,解决实时视频世界模型持续scaling问题,从内测case来看玩法丰富,其底层技术也有大幅改进。

机器之心
产品应用8

Claude统治一切!吞下这颗红药丸,焊工也是顶尖程序员

一种被称为「Claude - pilled」的现象在硅谷蔓延,焊工、律师等非程序员用Claude Code写APP,程序员护城河渐崩。但工程师用它后学习速度下降,社区探索让AI成导师的办法,且软件开发范式正转变。

新智元
新闻资讯8

马斯克点火全球最大超算,首个1GW狂飙奇点!6万亿Grok 5在训

马斯克官宣全球首个吉瓦级超算Colossus 2上线,狂堆55万块GPU,目标百万。下一代Grok 5已在训练,6万亿参数将引爆智能奇点。同时,全球AI巨头掀起算力军备赛,但美国面临电力短缺难题。

新智元
开源动态8

让AI当「动作导演」:腾讯混元动作大模型开源,听懂模糊指令,生成高质量3D角色动画

3D角色动画创作面临成本高、数据稀缺等问题。腾讯混元团队研发的混元Motion 1.0动作生成基础模型于2025年12月30日开源,通过全链路算法创新,为3D角色动画生成确立新技术范式

量子位
算法论文8

一个模型统一4D世界生成与重建,港科大One4D框架来了

港科大研究团队提出 One4D 框架,可统一 4D 生成与重建,构造同步输出多模态的视频扩散模型,支持多种任务形态。其有 DLC、UMC 等亮点,用合成与真实数据混合策略训练,实验表现佳。

机器之心
开源动态8

自回归科学基座模型 BigBang-Proton,提出实现 AGI 的新路线

超对称公司发布自回归科学基座模型 BigBang - Proton,挑战主流 AGI 技术路线。它实现多学科问题与 LLM 统一训练和推理,有三项创新,在多专业任务表现出色,还提出宇宙尺度压缩构想。

AI科技大本营
开源动态8

TinyAI :全栈式轻量级 AI 框架

TinyAI是用Java实现的全栈轻量级AI框架,具有教育友好、模块化等特点。它分层设计,涵盖数学运算、神经网络等模块,支持多种模型架构与并行训练,还有智能体系统,可用于多领域,未来规划丰富。

阿里云开发者