实时生成」共找到 2434 篇相关文章

新闻资讯8

拥有Github 的微软终于出手,发布一键生成全栈应用的GitHub Spark!

微软发布GitHub Spark,能以自然语言生成全栈应用并一键部署,默认用Claude Sonnet 4。它遵循微应用理念,有强大功能体系,深度集成GitHub。开发者看法不一,目前向Copilot Pro+用户开放,或改变市场格局。

AGI Hunt
新闻资讯7

大神李沐回归B站「做了个实时数字人」,直言「水平吊打我自己」

大神李沐回归B站,展示用创业公司BosonAI的Higgs Avatar v1模型做的实时数字人,称其水平“吊打自己”。该模型能带来接近真人的临场感,操作简单,有四大核心优势,已进入内测。

机器之心
产品应用7

Medeo 教程:一次生成无脑抽卡不可取,真正的视频 Agent 应该啥样

本文介绍AI视频生成Agent Medeo 1.0版本,它支持短或超长提示词,泛化性好,多种垂类视频都能做。文中介绍其基础操作、展示案例和提示词,还剖析了能兼顾质量与灵活度的原因,目前产品在内测将全量上线。

歸藏的AI工具箱
产品应用8

理解、生成、编辑一次搞定:Skywork UniPic 2.0的统一多模态解法|甲子光年

电商团队常面临创作流程繁琐问题,当前行业需统一架构。昆仑万维发布Skywork UniPic 2.0,整合理解、生成、编辑功能。它参数小性能优,还构建奖励模型,配合其他模型构建体系,具成本等优势。

甲子光年
开源动态8

代码库的AI觉醒!GitMCP开源神器:实时文档中心秒级搭建,终结代码幻觉!

AI助手处理项目文档常“幻觉”频发,GitMCP这款开源工具通过MCP将GitHub仓库转变为实时文档中心,让AI直接访问最新文档和代码,消除“代码幻觉”。它功能强大,配置简单,应用场景广泛。

开源星探
算法论文8

首帧的真正秘密被揭开了:视频生成模型竟然把它当成「记忆体」

UMD、USC、MIT研究团队发现视频生成模型会把首帧当作‘概念记忆体’,将视觉实体存于首帧并在后续复用。基于此提出轻量方法FFGo,用少量例子让模型实现SOTA级视频定制。

机器之心
开源动态8

如何做到在手机上实时跑3D真人数字人?MNN-TaoAvatar开源了!

阿里巴巴淘宝Meta技术团队研发的TaoAvatar技术,能在手机或XR设备实现3D数字人实时渲染与AI对话。今日开源MNN - TaoAvatar应用,可在手机运行,对比主流方案更高效便捷,还介绍其优势、技术及使用说明。

机器之心
新闻资讯7

讲习班日程公布|第四届全国大模型智能生成大会(LMG 2025)

第四届全国大模型智能生成大会(LMG 2025)11月1 - 3日在成都召开,预计超千人参会。11月3日的讲习班邀请四位青年专家,围绕AI基础设施、扩散语言模型等前沿议题,分享技术进展与实战经验。

深度学习自然语言处理
算法论文8

相机参数秒变图片!新模型打通理解生成壁垒,支持任意视角图像创作

S-Lab等机构研究员提出Puffin统一多模态模型,它能整合理解相机参数与按参数生成对应视角图片的能力。通过“用相机思考”和400万组数据训练,解决此前模型问题,还构建相关数据集和评测基准,性能出色。

量子位
产品应用8

通用级PixVerse P1的技术突破,揣着进入平行世界的密码

PixVerse R1 突然上线,带来「即时响应、即看即创」新体验。它是全球首个支持最高 1080P 分辨率通用实时世界模型,实现从「静态输出」到「实时交互」跨越,本文将解析其技术突破。

机器之心