超并行实验」共找到 3406 篇相关文章

算法论文8

腾讯AI Lab首创RL框架Parallel-R1,教大模型学会「并行思维」

腾讯AI Lab等机构研究者首创Parallel - R1框架,通过强化学习让大模型掌握并行思维。它解决了RL训练的冷启动和奖励设计难题,在多数学基准上提升准确率,还揭示模型思维策略变化及并行思维的‘脚手架’作用。

机器之心
产品应用7

机器人是具身大模型的「用户」:维动力如何打通从人类经验到机器人行动?

今年WAIC,维动力展台的乒乓球桌和双臂机器人开易拉罐演示吸引关注。其机器人90%经验来自人类第一视角数据,维动力全栈布局,试图打通人类经验到机器人行动链路,目标是建立机器人持续进化方式。

机器之心
算法论文8

CVPR 2025 Oral | DiffFNO:傅里叶神经算子助力扩散,开启任意尺度分辨率新篇章

本文由圣路易斯华盛顿大学与北京大学联合完成,提出DiffFNO以神经算子赋能扩散架构,支持高质、高效、任意连续倍率分,介绍其核心思路、组件及优势,在多数据集上领先SOTA方法,为分提供新思路,适用于多领域。

机器之心
8

华师大智金院孵化金融原生基模Mint-Agent:越GPT-5.6与Claude Opus 4.8,商业订单已亿元

华东师大智金院团队孵化的金融原生基模 Mint - Agent 发布,在 FinanceAgentBench v2 上表现 GPT - 5.6 - Sol 与 Claude Opus 4.8,单题推理成本低,商业订单亿元,进入规模化金融场景验证阶段。

机器之心
产品应用7

10个Agent一键组队:并行智能体协作,端到端交付从24h缩减到4h!

过去写代码靠程序员手动输入,即便有Copilot等工具,仍需人主导。并行代理出现后,程序员可调用多个AI并行工作,将端到端交付时间从24h缩减到4h,思维方式也需转变,对工程师能力要求也有变化。

新智元
开源动态8

牛!小米开源「音频语言模型」,1亿小时预训练时间,音频理解和输出能力是真顶!

小米推出开源音频语言模型MiMo - Audio,有1亿小时预训练时间。它能理解音频,70亿参数模型在多基准测试达SOTA,音频理解Gemini - 2.5 - Flash,复杂推理优于GPT - 4o - Audio,还支持多模态任务。

开源AI项目落地
算法论文7

Megatron 1F1B流水线并行中的负载不均衡问题研究

文章分析Megatron 1F1B流水线并行中负载不均衡问题。通过实验发现通信时间‘一短一长’,原因是最后一个Stage计算慢致不同步,额外计算引发通信延迟,还梳理了流水线各阶段执行过程。

GiantPandaLLM
新闻资讯7

独家|拿下5亿元海外订单,无界动力完成天使++轮融资,天使轮累计融资2亿美元

AI科技评论独家获悉,通用具身智能机器人公司无界动力完成天使++轮融资,累计2亿美元,天使+++轮也接近完成。其以隐空间世界模型构建具身大脑,区别于主流架构。还获远景5亿订单,商业化落地成果多。

AI科技评论
开源动态7

Claude时代终结?LMArena实测DeepSeek R1编程得分Opus 4,但月暗称其新模型更胜一筹

在闭源模型主导的AI环境下,开源的DeepSeek - R1(0528)在LMArena测试中表现亮眼,编程得分Claude Opus 4,引发社区关注与讨论。不过LMArena曾被指责偏袒,其联合创始人反驳。此外,月之暗面新模型Kimi - Dev - 72B编程成绩R1。

AI前线
算法论文8

用SFT打出RL的效果?微软联合提出高效后训练算法

大模型后训练阶段,SFT 和 RL 各有优劣。微软等联合提出新工作,量化 SFT 和 RL 在数据层面的差距,提出 IDFT 和 Hinted Decoding 等高效后训练技术,实验显示新方法泛化 SFT、效率 RL。

机器之心