多人物视频生成」共找到 2704 篇相关文章

新闻资讯7

告别Sora!从巅峰到黯然离场不到一年半,团队将转向物理AI

2026年3月24日,OpenAI宣布关闭视频生成应用Sora。Sora曾惊艳全球,但因合规麻烦、行业阻击、算力成本高、商业回报低等问题走向关停。团队将转向物理AI,聚焦世界模拟研究。

AIGC开放社区
产品应用8

豆包 Seed 2.0 来了:字节模型跨越鸿沟

春节前字节发布豆包大模型 2.0,其在 Text 领域进入榜单前十,视觉能力全球第四且成本低。它定位多模态 Agent 模型,有多种能力升级,文中用多个案例展示其强大,还强调字节重原生能力非简单蒸馏。

MacTalk
新闻资讯8

腾讯张正友:具身智能必须回答的三个「真问题」

7月27日,腾讯发布具身智能开放平台Tairos。发布会后,腾讯张正友剖析战略选择背后的三个核心问题:架构上主张分层架构;认为具身智能第一性原理是身脑融合;强调要为长远目标放弃短期商业利益。

机器之心
新闻资讯8

All In AI的Google I/O 2025还开源了一系列模型,冲~

谷歌CEO称Google IO 2025上,数十年AI研究成果已成为现实。大会亮点多与AI相关,如Gemini 2.5系列模型表现出色,还有Veo 3等。此外,还开源了medgemma、gemma - 3n等模型。

PaperAgent
产品应用7

谷歌 Gemini 的新功能 Storybook 很有意思.....

推荐大家体验谷歌Gemini的新功能Storybook,它能生成任何主题的有声故事绘本。如以动漫风格介绍马斯克生平、梳理ChatGPT诞生后的AI发展等,虽有转换性别等情况,但免费且想象空间大。

AI寒武纪
开源动态8

腾讯混元最新开源:一套RL框架打通多个模态,庞天宇团队新作

大语言模型的RL技术已成熟,但多模态生成模型的强化学习训练仍“各自为战”,制约AIGC模型能力上限。腾讯混元庞天宇团队开源UniRL框架,打通多模态RL后训练,覆盖多种模型,内置算法与奖励组件。

量子位
新闻资讯8

中国科学家首次手搓出“球状闪电”!刘慈欣科幻小说照进现实

4月16日,中科院上海光机所团队在《自然·光子学》发文,首次在实验室可控生成具球状闪电典型特征的宏观电磁孤子。其存活时间长、空间尺寸大,还能为研究提供受控平台,有潜在应用价值。

DeepTech深科技
新闻资讯7

OpenAI o3-pro模型发布,但不能聊天

当地时间6月10日,OpenAI o3 - pro模型发布,ChatGPT Pro用户可通过API使用。它是o3子版本,在多领域表现出色,但响应慢,适用于对可靠性要求高的难题。目前临时聊天功能停用,不支持图像生成和Canvas。

AI前线
产品应用7

首发丨手机的『魔法挂件』,实测钉钉dingtalk A1,有用的好帮手

2025年基于大模型的AI硬件焕发生机,钉钉dingtalk A1是其中代表。它厚度仅3.8mm,使用方便,具备会议录音转写、纪要生成、通话分析等功能,还能用于学习和生活场景。

鲸选AI
产品应用7

精准复刻!字节推出X-UniMotion实现高精度动作模仿合成

字节推出的X-UniMotion代表角色动画技术突破,提供统一运动控制系统,融合先进算法与操作界面,构建强大技术架构,能生成自然流畅角色动作,还介绍了其技术原理、演示对比等内容。

带你学AI