数字人视频」共找到 2219 篇相关文章

新闻资讯8

AI转型最大的门槛,不是技术,是

浪潮信息董事长彭震在工智能+生态大会上提出,AI转型最大门槛是而非技术。他指出组织力不足影响业务效果,提出Humagent概念。浪潮信息还从文化、组织、流程层面推动转型,愿做客户同行者。

量子位
新闻资讯7

第一批买机器做家务的崩溃了

第一批买机器做家务的崩溃了,自主机器常闯祸,体验感差。传奇程序员卡马克建议卖远程家政服务,如1X Technologies的NEO机器就是远程操控。但也有认为机器应具自主性,部分企业还搞预售圈钱。

量子位
算法论文8

演讲生成黑科技,PresentAgent从文本到演讲视频

联合团队提出 PresentAgent,能将长篇文档转化为带解说演示视频。采用模块化流程,还引入 PresentEval 评估框架。实验显示其接近类表现,优于现有方案,展现了多模态智能体潜力。

机器之心
产品应用8

智谱AI发布桌面Agent,轻松训练 AI数字员工

智谱AI发布ComputerRL自主桌面智能框架,旨在让AI像一样用电脑。它融合API与GUI,采用分布式训练,引入Entropulse解决探索衰减。在OSWorld测试中表现亮眼,虽有视觉感知等挑战,但意义重大。

AIGC开放社区
产品应用8

32个随机数字,1分钟推演地球未来15天丨谷歌DeepMind

谷歌DeepMind发布WeatherNext 2,运行速度比上一代快8倍,分辨率达小时级。其关键是新提出的FGN功能生成网络,通过输入32个随机数字生成多样天气情景,速度快且准确率高,虽有小瑕疵但实用。

量子位
新闻资讯7

Sora 关停背后:为啥它没跑成“视频版 ChatGPT”?

OpenAI Sora 宣布关停,其评论区评价两极分化。它没跑成“视频版 ChatGPT”,问题在于使用频率、成本结构和产品形态。关停或与 OpenAI 筹备 IPO 有关,未来 Sora 团队将推进相关研究。

InfoQ
开源动态8

世界模型一口气输出小时级视频不跑偏,开源了

Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。

量子位
产品应用8

全网实测Gemini Omni!一句话改视频,草图变大片

谷歌在Google I/O大会推出Gemini Omni,它结合推理与生成能力,在多方面有重大飞跃,能生成逼真视频等。它打破命名体系,训练目标不同,有涌现能力,谷歌还为其设置限制。

新智元
推荐文章8

为什么今天造大模型的,一半在学物理

文章指出在AI前沿,不少定义方向的出身物理。物理训练赋予的品味与做AI的方法论高度重合,体现在统计力学与神经网络、对普适规律的信仰等方面,还提到Scaling Laws最能体现这种品味。

五源资本 5Y Capital
新闻资讯7

Figure机器分拣快递新视频曝光,网友:太像

Figure 02机器开启打工模式,创始放出其分拣快递新视频,它动作流畅像类,由端到端通用控制模型Helix自主驱动。此前它还在宝马生产线连续20小时轮班作业,Figure与OpenAI分道扬镳后推出Helix。

量子位