未标注视频」共找到 1759 篇相关文章

算法论文7

CoT 之后,CoF 如何让帧间逻辑从「隐式对齐」变成「显式思考」?

CoT 虽提升语言模型推理能力,但在 C 端场景有局限,且被质疑并非真实推理。视觉领域提出 CoF 概念,Google DeepMind 团队引入理论,让视频模型通过帧链推理提升帧间一致性,还具强大泛化能力。

机器之心
新闻资讯7

OpenAI强硬回击马斯克窃密诉讼!xAI被指恶意人肉离职员工

被马斯克xAI起诉窃密一周后,OpenAI回应,递交答辩状和驳回动议申请,全面否认指控,斥责马斯克滥用诉权滋扰。xAI提出三项指控,OpenAI则逐一驳斥,称招聘合法合规,接触其机密。

量子位
新闻资讯7

OpenAI世纪诉讼,马斯克输了!

马斯克诉OpenAI 1500亿美元案件,陪审团90分钟全票驳回,原因是诉讼时效已过。虽审理实质指控,但庭审揭开OpenAI隐秘运作。此判决为OpenAI IPO扫清障碍,双方后续还有多起诉讼待决。

新智元
新闻资讯7

老思维做 Agent,没戏!云厂商们又想憋大招了

企业落地 Agent 经历快速演化,自主性 Agent 成新趋势。云厂商起初推 AI Infra,现转以 Agent 应用为中心开启 Agent Infra 赛道竞争,虽已布局但新开发范式成型,来需产业链协作迭代。

InfoQ
新闻资讯7

亚历山大王回应一切:LeCun、Manus,“我的父母都是中国人”

亚历山大王加入Meta近一年后首次公开回应争议。他谈了Muse Spark技术逻辑、Meta超级智能实验室架构等,还分享八卦,如与奥特曼决裂代价、小扎抢人真相,认为AI终局开始,科技行业将分层。

量子位
新闻资讯7

IMO题库“过时”了!OpenAI内部模型挑战最新First Proof,做了7天错了一半

谷歌发布Gemini 3 Deep Think爆火后,OpenAI用发布内部模型,一周内尝试解答10道来自数学家科研现场的真实问题,5道基本正确。这些题取自真实研究,切断模型“背答案”可能,意味着自主推理能力进化。

量子位
新闻资讯8

AI 行业最新的 18 个前沿认知

文章整理了火山引擎AI领航者计划活动中,大厂、投资人和创业者对AI行业的18条前沿认知,涵盖模型层、应用层和产业层,如强化学习成竞争焦点、视频生成将崛起等,展现2026年行业新趋势。

特工宇宙
新闻资讯8

Gemini负责人爆料!多模态统一token表示,视觉至关重要

Gemini模型行为产品负责人Ani Baddepudi与谷歌AI Studio产品负责人探讨Gemini多模态技术,涉及设计理念、应用及发展方向。指出多模态对构建AGI重要,还介绍Gemini 2.5视频理解亮点与‘万物皆视觉’理念。

量子位
推荐文章7

LLM学习笔记:最好的学习方法是带着问题去寻找答案

文章总结拓展Andrej Karpathy教学视频,分析大模型聊天流程与原理,介绍LLM训练步骤,包括预训练、后训练和强化学习,还提及主流特性应用,如文件上传、网络搜索,强调带问题学习的重要性。

腾讯技术工程
开源动态8

告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源全曲级MV生成Agent

现有AI视频生成模型做全曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。

量子位