「AI视频大模型」共找到 13620 篇相关文章
AI 落地实录:我们如何重构业务流程与组织协作
InfoQ《极客有约》X AICon 直播栏目邀网易蓝师师、腾讯张瀚元、国际头部 ERP 企业吴云,探讨 AI 重塑业务价值与提升效能。分享各行业 AI 提效实践、业务重塑案例,还讨论 AI 应用方向及落地挑战等。
谷歌DeepMind深夜放核弹:世界模型Genie 3登场,重新定义“生成式AI”
谷歌DeepMind推出第三代通用世界模型Genie 3,能生成多样化交互式环境,可实时导航。它较前代有诸多突破,有模拟物理特性等核心能力,能赋能具身智能体研究,但也存在行动空间有限等局限。
太狠了!为了锁死DeepSeek,Anthropic要求加大AI芯片出口管制
全球著名大模型平台Anthropic发布文章,赞同并建议特朗普制定更激进规则限制AI芯片出口,以保持美国在与中国AI竞争中的领先地位,还污蔑中国运输芯片方式,拿DeepSeek举例说明芯片限制影响,并提出三点限制建议 。
AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型
威斯康星大学麦迪逊分校联合清华大学的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,让AI“读懂人心”。其框架分三阶段,还有动态社交记忆,在多基准测试表现出色。
让AI生成视频「又长又快」:Rolling Forcing实现分钟级实时生成
南洋理工大学与腾讯ARC实验室联合研究,由博士生刘坤昊等完成,提出Rolling Forcing方法,通过滚动窗口联合降噪等创新设计,突破实时长视频生成瓶颈,实现分钟级实时生成,还支持交互控制,但仍有优化方向。
独家 | 开普勒联合创始人胡德波成立「索塔无界」,聚焦通用基座模型+海外市场
AI科技评论独家消息,开普勒机器人联合创始人胡德波2026年4月成立索塔无界。该公司聚焦通用基座模型,以统一潜空间世界动作模型为核心,提出物理智能大脑技术路线,已与欧美企业达成合作意向。
微软 CEO 纳德拉:离了 AI 软件开发没法想!编程如诗都是“压缩”。社区:必须拥抱变化。
微软CEO纳德拉在访谈中表示,如今软件开发离不开AI,AI编程已成标配。他强调AI本质是赋能人类的工具,还提及AI普及挑战,同时保持对AI局限性的清醒认知,分享领导哲学与诗意展望。
浙大联手字节:开源大规模指令跟随视频编辑数据集OpenVE-3M
浙江大学与字节跳动合作,提出大规模指令跟随视频编辑数据集 OpenVE-3M,有 3M 样本对。还提出数据构造管线、编辑模型 OpenVE-Edit 及评测集 OpenVE-Bench,小参数量下超越现有开源模型。
全球首个完全AI编写的训练框架来了,速度反超英伟达:面壁要用 AI 把国产算力软件重写一遍
面壁智能发布全球首个全由AI编写的训练框架ForgeTrain,在华为昇腾系列上验证,速度超英伟达Megatron 10%。其构建分三阶段,目标是为不同需求“现场锻造”软件,还为国产算力软件生态赶超提供新思路。
“图片秒生”,腾讯混元图像2.0模型正式发布,主打速度和真实感
5月16日,腾讯发布混元图像2.0模型,率先实现实时生图,生图速度快、质量高,能避免‘AI味’。在GenEval基准上准确率超95%,还发布实时绘画板功能,后续将推原生多模态模型。