「AI视频编辑」共找到 10265 篇相关文章

新闻资讯7

40位数学家组成8队与o4-mini-medium比赛,6队败北

Epoch AI安排40位数学家组成8支战队,与OpenAI的o4 - mini - medium模型对决,考题来自高难度的FrontierMath数据集。结果AI以6:2击败人类,不过Epoch AI认为AI未明显超人类,但很快会达到。

机器之心
开源动态8

看完Kimi K2.5技术报告,它的视觉Agentic真给我惊到了

Moonshot AI发布Kimi K2.5技术报告,该模型将文本和视觉打通,有并行执行的智能体集群系统。它采用Joint Training,提出“Zero-Vision SFT”,用MoonViT - 3D处理图像和视频,开源后受欢迎,展示通用智能体可能。

PaperAgent
新闻资讯8

百度:和大家一起讲 「超级有用」的故事

作者参加百度AI DAY智能云创新行业专场,看到百度全栈AI解决方案矩阵及应用案例。百度通过构建生态、全栈自研、推动科技平权等举措发力AI,诸多应用已取得商业成果,有望在AI商业化长跑中胜出。

MacTalk
新闻资讯8

硅谷今日最热具身模型!不用后训练,看一遍就学会

北美具身初创Skild AI发布全新机器人基础模型S1,主打上下文学习,能看示范视频完成复杂操作。在未见过任务上成功率达66%,远高于传统方法。其发展或让开发机器人技能像给ChatGPT写Prompt。

量子位
新闻资讯8

Gemini 3.5来了!今夜,谷歌亲手淘汰谷歌

谷歌I/O 2026大会火力全开,发布Gemini Omni、3.5 Flash、Spark等新品。Omni可接收任意输入生成视频,3.5 Flash性能强大,Spark是7×24h云端个人AI特工。谷歌多项能力同时到位,撕开了ASI入口。

新智元
产品应用8

一款产品,同时为人类和 Agent 设计,LibTV 是怎么做的?

3月18日,LiblibAI旗下AI视频创作平台LibTV上线,它从设计之初就兼顾人类创作者和Agent。创作者端工作流画布可控;Agent端可通过Skill接口创作,交付可编辑项目。该产品还针对两者差异做了设计,价格也便宜。

Founder Park
开源动态8

设计师的天塌啦!!!1k Star Editable Design

本文介绍上线不久就收获1k Star的开源项目Editable Design,该项目针对AI设计交付后无法灵活修改的痛点,提出由Agent生成带结构的可编辑设计,支持HTML和PPTX格式,适配需要反复修改的设计场景。

小华同学ai
产品应用8

Nano-Banana 核心团队分享:文字渲染能力才是图像模型的关键指标

谷歌新发布的图像生成与编辑模型Gemini 2.5 Flash Image(Nano - Banana)热度超Grok视频生成。文章通过团队访谈,介绍其图像创作新方式、文字渲染代理指标、交错生成能力等,还对比了与Imagen差异,展望AI终极形态。

Founder Park
新闻资讯7

苹果密谋300亿美元天价收购Perplexity,小扎狂挖印度裔CEO!

AI战火正旺,苹果考虑收购估值140亿美元的AI初创公司Perplexity,这或成其史上最大规模收购。Perplexity有实时联网的AI搜索引擎等,苹果有三种合作设想,但三星或抢先合作。此外,Meta曾想收购Perplexity,后投资Scale AI。

新智元
新闻资讯8

刚刚,一口气连发3个王炸模型、亮出2026年AGI战略,昆仑万维夯爆了

27日下午,昆仑万维在2026中关村论坛发布全新AI游戏世界模型Matrix - Game 3.0、AI视频大模型SkyReels V4和AI音乐大模型Mureka V9,还公布2026 AGI战略,推动AI从全模态能力突破进入平台化构建阶段。

机器之心