模型训推」共找到 8064 篇相关文章

新闻资讯7

告别功能内卷,产业AI需要一记“ACE球” | 甲子光年

文章指出产业AI在金融等行业落地面临挑战,投入产出错配。蚂蚁数科在外滩大会出‘按效果付费’模式,提出‘ACE’方法论,以行业大模型和实战经验助力落地,成果初显,有望动AI to B行业变革。

甲子光年
产品应用8

马斯克AI女友直播「一秒变身」,Karpathy看完立刻投钱

世界首个支持直播流的「实时」扩散AI视频模型MirageLSD诞生,大神Karpathy亲自站台。它能理解真实视频后同步生成AI视频,实现零延迟、无限时长、每秒24帧不卡顿,给视频娱乐和直播互动带来丰富想象。

新智元
算法论文8

与Gemini Diffusion共振!首个扩散式「发散思维链」来了

西湖大学齐国君教授团队提出扩散式「发散思维链」,这是面向扩散语言模型的新型理范式。它与传统思维链不同,能非线性生成,已应用于两种模型,增强后的模型在相关任务上超越现有模型

机器之心
新闻资讯7

奥特曼:我不会让儿子和AI交朋友!与丈夫的家庭生活首曝光

2025年奥特曼出席美国国会山听证会,反对强监管,称其会对美AI竞赛造成灾难性影响,还透露OpenAI首个开源模型今夏发布。此外,他分享了智能时代路线图,谈到中美AI竞争等问题,其家庭生活也首次曝光。

新智元
推荐文章7

Agent 真正的护城河,正在从工具转向记忆资产

2026年初,Anthropic用Claude Cowork引发AI创业热点,其计划引入知识库获“永久记忆”能力,将Agent Memory探索到前沿。文章探讨独立Memory层成必需品的原因、工程化记忆系统的能力,还对比模型厂商和第三方中立派路线。

Founder Park
算法论文8

视频生成一长就漂移竟是前序帧「太干净」惹的祸!研究揭示共享噪声水平才是长视频稳定关键

自回归视频生成模型存在不一致导致的误差累积问题,使生成视频越往后越易出现时序漂移和画面崩坏。HiAR团队出HiAR,通过共享噪声水平减少误差传递,还解决了动作僵化问题,实现分钟级无退化生成。

量子位
算法论文8

NeurIPS 2025 Spotlight | 选择性知识蒸馏精准过滤:测解码加速器AdaSPEC来了

大型语言模型理延迟高、开销大,测解码可加速但依赖草稿与主模型一致性。佐治亚理工等团队提出 AdaSPEC 蒸馏法,过滤难学 token,提升草稿模型与目标模型对齐度,实验显示能提升接受率和理速度。

机器之心
推荐文章8

从“暴力烧Token”到“系统工程”:OpenAI与华为的两条 AI 编程路径

文章对比OpenAI与华为的AI编程路径,指出模型中心派靠高上下文窗口但有成本高、延迟大等问题;工具驱动派如Cursor和华为云码道重构IDE工具。码道将任务解耦,通过多技术实现性价比,还介绍了底层基石及其实测表现。

InfoQ
新闻资讯7

Claude 小升级就赢了OpenAI 9年“开源神作”?高强度理直接歇菜、幻觉率高达50%,写作还被Kimi 2吊锤?

OpenAI发布首个开源语言模型系列gpt - oss,包括gpt - oss - 120b和gpt - oss - 20b,可在Hugging Face下载。同期谷歌DeepmindGenie 3,Anthropic放出Claude Opus 4.1。Claude Opus 4.1编程性能提升,实测编码能力强于gpt - oss。gpt - oss虽有亮点,但幻觉率高、实测效果不佳。

AI前线
产品应用8

Meta「分割一切」进入3D时代!图像分割结果直出3D,有遮挡也能复原

Meta MSL实验室发布三维重建模型SAM 3D,其家族的两个新模型能将2D图像转为3D重建模型,性能优异。同时,此前投稿ICLR 2026的SAM 3也亮相,可克服传统模型局限,在多项任务中刷新SOTA。

量子位