「大模型训练」共找到 9652 篇相关文章

开源动态8

蚂蚁开源 Ring-1T,成就推理、编程、通用智能三冠王

蚂蚁开源团队推出 Ring-1T 模型,它结合强化学习与多阶段推理机制,实现从‘模仿’到‘思考’的转变。该模型在多基准测试表现优异,其高性能得益于 IcePop、C3PO++、ASystem 三项关键技术。

AI科技评论
算法论文8

OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式

现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。

带你学AI
产品应用8

首创双NPU架构一鸣惊人!联发科天玑9500重磅加码主动式AI体验

联发科天玑9500首创超性能+超能效双NPU架构,让AI始终在线,融入用户操作。其输出性能、上下文窗口等有显著提升,还解决了模型加载慢等问题,与多厂商合作推动端侧AI落地。

量子位
开源动态8

紫东太初开源视觉神经增强方法,即插即用终结多模态幻觉 | ACL 2025

中科院自动化所等团队提出VHR方案,通过“视觉神经增强”机制放大模型视觉关键注意力头输出,降低幻觉现象。此前主流方法多作用于最终输出阶段,VHR深入干预内部机制,还介绍了SSL语义引导方法。

量子位
推荐文章8

谁在赚钱,谁爱花钱,谁是草台班子,2025 年度最全面的 AI 报告

Nathan Benaich发布《State of AI Report(2025)》,如AI全景地图,覆盖研究、行业等领域。2025年AI业务赶上炒作,模型竞争激烈,开源、智能体等发展显著,还对未来一年AI发展作出预测。

Founder Park
开源动态8

特斯拉开源硬件,中国公司回应来了:直接把机器人大脑开源了

特斯拉开源硬件专利后,智平方于4月22日发布AlphaBrain Platform开源社区,拿出含具身前沿技术等的“顶配全家桶”。介绍了世界模型、RL Token等5大技术亮点,还说明其用途及智平方过往开源成果与公司实力。

量子位
新闻资讯8

Generalist最新长文定调:具身原生才是正道,中国玩家原力灵机已交卷

Generalist创始人Pete Florence团队释出GEN-1技术博客,否定世界模型与VLA之争,强调具身智能应回归目标,主张从零训练。中国原力灵机DM0也采用具身原生路线,在RoboChallenge评测中成绩优异。

量子位
开源动态8

首个完整开源的生成式推荐框架MiniOneRec,轻量复现工业级OneRec!

中科大LDS实验室与Alpha Lab团队联合开源MiniOneRec,是生成式推荐首个完整端到端开源框架。它验证生成式推荐Scaling Law,可轻量复现OneRec,提供一站式训练与研究平台,技术优势明显。

机器之心
新闻资讯8

斯坦福临床医疗AI横评,DeepSeek把谷歌OpenAI都秒了

斯坦福最新大模型医疗任务评测,构建含35个基准测试的MedHELM综合评估框架。结果显示,DeepSeek R1以66%胜率领先,o3 - mini等模型也各有表现,还分析了成本效益。

量子位
推荐文章9

Jev火了,但真正重要的不是Jev | 5Y View

TypeSafe AI发布专用决策模型Jev后引发开发者社区关注,本文跳出Jev本身讨论,重新审视大模型通用生成的默认前提,提出AI计算专用化与任务分工的核心观点,预判AI行业发展趋势。

五源资本 5Y Capital