「视频预训练」共找到 3033 篇相关文章
豆包19亿次互动背后的技术真相:春晚级体验是如何炼成的?
2026 年春晚 AI 元素亮眼,豆包 AI 互动达 19 亿次。火山引擎作为独家 AI 云合作伙伴,用智能视频云等技术打造节目效果,解决视频画质、空间逻辑、机器人互动延迟等难题,还保障全民互动和实时字幕。
吴恩达新作:87%推理token用不着,丢掉反而快3倍
吴恩达新作Prefix Sliding指出,模型推理时丢弃中间已贬值token,只保留前缀+滑动窗口,无需训练可提速3倍,配合RL训练能将推理轨迹扩展到10万token以上。该方法为Agent场景提供新思路。
Gemini 3 Pro加持!这款开源神器 Clipsketch AI,帮你自动抓帧、画图、写爆文!
自媒体内卷,‘视频转图文’是流量入口,简单截图难满足需求。clipsketch - ai 开源项目用 Gemini 3 Pro 和 Nano Banana Pro 模型,实现视频理解、AI 绘画和写作自动化,解决创作者素材整理、版权等痛点。
如何利用pytorch memory snapshot进行显存分析
文章聚焦于用pytorch memory snapshot分析模型训推显存消耗,不讨论工具使用,侧重解读记录内容。以混合精度训练为例,介绍各步骤显存管理细节,还给出单层、双层模型及zero1训练的显存分析。
Pulsar特性在AI场景中的使用
随着AI发展,架构从单体到分布式演进,消息中间件成关键。Pulsar以存算分离等特性价值凸显,在多模态训练、模型训练、智能体等AI场景有独特优势,如处理超大消息、实现断点续训等。
The Batch: 839 | 好莱坞加入 AI 版权之争
好莱坞电影公司加入对用其版权作品训练AI模型公司的抗争。迪士尼和环球起诉Midjourney,指控其未经授权用版权作品训练模型、分发含其角色图像,请求停侵权并索赔,版权法相关界定尚不明确。
国产AI击败Meta:ReasonRank荣登BRIGHT榜单第一
基于LLM的段落排序方法中,listwise排序虽有优势,但当前重排器难处理复杂推理查询。ReasonRank通过生成推理密集型训练数据及两阶段后训练,赋予listwise重排序器强推理能力,在BRIGHT榜单击败Meta。
华为创造AI算力新纪录:万卡集群训练98%可用度,秒级恢复、分钟诊断
大模型落地需强大算力集群支撑,构建万卡级算力集群是顶尖挑战。华为昇腾万卡算力集群近乎‘永不罢工’,其公开技术秘密,提出‘3+3’双维度技术体系,多项指标表现优异。
媲美Claude 4,支持100万上下文!阿里开源超强代码AI Agent模型
阿里巴巴开源超强AI Agent模型Qwen3 - Coder - 480B - A35B - Instruct,测试分数媲美Claude Sonnet 4,超越DeepSeek。它参数多、支持大上下文窗口,训练数据优质,还进行代码强化学习扩展训练等,有对应命令行工具。
史上最大高质量科学推理后训练数据集开源,快速让Qwen3等变“科学家”
上海创智学院、上海交通大学发布开源科学推理后训练数据集MegaScience,含约125万条问答对,覆盖多学科。它解决了现有数据集的问题,实验显示能提升模型科学推理能力,已完整开源相关组件。