视频预训练」共找到 3057 篇相关文章

新闻资讯7

突发:SpaceX 或 600 亿美元收购 Cursor

SpaceX官宣与Cursor合作,打造编程和知识工作AI。Cursor授予SpaceX今年晚些时候以600亿美元收购的权利,或支付100亿合作费。Cursor增长快但无自研模型,合作可助其训练模型。此外还介绍了编程AI市场竞争情况。

AGI Hunt
产品应用7

阿里首个世界模型:快乐…生蚝

刚成立一个月的阿里ATH事业群发布全球首个主动式实时交互世界模型HappyOyster(快乐生蚝),它搭载原生多模态架构,有漫游、导演、创造、分享等玩法,目前需邀请码体验。其技术突破让它区别于传统文生视频模型。

量子位
产品应用8

aiX-apply-4B逆袭DeepSeek-V3.2!aiXcoder发布代码变更应用模型,单卡推理提效15倍

3月25日,硅心科技发布专为代码变更应用场景设计的模型aiX - apply - 4B。它平均准确率达93.8%,超越Qwen3 - 4B和DeepSeek - V3.2,算力成本仅为后者5%,推理速度提15倍。还采用创新训练方法,适配企业场景。

机器之心
新闻资讯7

AI5芯片搞定,马斯克的纯自研超算Dojo 3又回来了

马斯克宣布AI5芯片设计进展顺利,特斯拉将重启Dojo 3工作。Dojo项目定位为面向机器学习训练的超算,此前曾暂停。如今Dojo 3将集成AI5或AI6芯片,有望助力特斯拉摆脱对英伟达依赖,自建算力体系。

机器之心
新闻资讯7

半佛怕爆款,三表拒AI,冰汝谢川普

在短视频和 AI 席卷内容行业的当下,今日头条 2025 年深度创作者大会上,驻美记者王冰汝、财经博主半佛仙人、自媒体人三表龙门阵分享了各自的焦虑与坚守。他们谈到爆款、AI 影响、创作模式等问题,展现不同生存哲学。

乱翻书
开源动态8

通过零开销逐层权重卸载技术将SGLang Diffusion wan2.2的推理速度加速60%

文章介绍在优化SGLang对Wan2.2视频生成模型支持时,发现双Transformer架构下第1步和第19步推理慢的问题。通过零开销逐层权重卸载技术,将整体推理速度提升60%,还突破显存墙,且该优化可扩展到其他模型。

GiantPandaLLM
算法论文8

Meta超级智能实验室又发论文,模型混一混,性能直接SOTA

大语言模型训练依赖算力和时间,传统模型 Souping 多采用均匀平均。Meta 等研究者提出类专家 Soup(SoCE),利用基准测试类别构成选最优模型,非均匀加权平均,实验显示其提升了模型效果与稳健性,在排行榜获 SOTA 成绩。

机器之心
新闻资讯7

Anthropic 联创:2028 年实现 AI 自我构建的概率超过 60%

Anthropic 联合创始人 Jack Clark 发长文称,到 2028 年底,AI 实现端到端自动化研发概率超 60%。他分析多维度测试数据,指出 AI 在代码、科研、自我训练和管理等方面能力提升,也探讨了成真后的影响,但遭黄仁勋和陶哲轩质疑。

AGI Hunt
开源动态8

分割一切并不够,还要3D重建一切,SAM 3D来了

深夜 Meta 重大更新,上线 SAM 3D、SAM 3。SAM 3D 含物体与场景重建、人体形状与姿态估计两模型,能将 2D 图转 3D 重建结果。SAM 3 可检测、分割与跟踪图像视频物体。Meta 开放模型权重与代码,推体验平台。

机器之心
新闻资讯8

一个上海AI独角兽爆发了

全球AI圈因MiniMax“发布周”沸腾。新模型MiniMax - M1被视为“性价比新王”,还有新视频、语音模型表现出色。其89年博士闫俊杰带队,在大模型研发上多次做非共识选择,现估值超30亿美元,还推出智能体产品。

芯师爷