生成式任务」共找到 4159 篇相关文章

开源动态8

美团视频生成模型来了!一出手就是开源SOTA

美团开源视频生成模型LongCat - Video,参数13.6B,支持文生/图生视频,时长可达数分钟,生成视频真实自然,文生视频能力顶尖,整体质量优,采用MIT协议。还介绍了其功能、技术原理及美团此前的AI成果。

量子位
算法论文8

CVPR 25 |全面提升视觉感知鲁棒性,生成模型快速赋能三维检测

香港中文大学(深圳)等单位学者提出 DriveGEN 无训练自动驾驶图像可控生成方法,无需额外训练生成模型,通过两阶段策略扩展训练数据,提升三维检测模型鲁棒性,代码已开源。

机器之心
产品应用7

我做了个 Skill:让 AI 帮你生成 Logo 和图标

作者因用 Gemini 为 CodePilot 生成 Logo 获关注,开发了 Logo Generator Skill。该 Skill 可三步生成 Logo 与高级展示图,还介绍了不直接用 AI 画 Logo 的原因、使用场景、开源地址与安装方

歸藏的AI工具箱
新闻资讯7

OpenAI版抖音要来了!Sora 2加持,只能发AI生成视频

OpenAI正为视频生成模型Sora 2推独立社交应用,形态似TikTok,内容须AI生成,不可上传外部媒体。有独特身份验证功能,已内部测试获积极反馈,将与Meta、Google、TikTok竞争。

AI寒武纪
产品应用8

Google 最新的 Gemini 2.5 Flash-Lite 原型能动态生成软件界面

Google最新的Gemini 2.5 Flash - Lite原型能动态生成软件界面。它打破传统预设框架,通过‘UI宪法’等设计保证风格与适应性,响应速度快,还解决了生成界面可能带来的混乱问题,或重塑人机关系。

宝玉AI
算法论文8

全球首个,连续时间具身世界模型!任意帧率自由生成

来自清华AIR与UC Berkeley BAIR的团队提出全球首个连续时间具身世界模型ODEWorld。它学习世界在每个时刻的变化方向与速度,能任意帧率自由生成,统一了离散模型分散的生成能力。

新智元
产品应用8

Nature报道:谷歌新模型1秒读懂DNA变异!首次统一基因组全任务,性能碾压现有模型

谷歌DeepMind团队推出生物模型AlphaGenome,能从1兆碱基DNA序列中预测数千种功能基因组特征,评估变异效应。它统一多任务,性能超现有模型,是生物领域里程碑,将助力理解疾病。

量子位
开源动态8

19.8K star!一款开源可视化工作流调度项目,轻松搞定大数据任务

Kestra 是开源工作流编排平台,用于处理复杂任务自动化问题。它跑在 JVM 上,用 YAML 配置,支持插件扩展。适用于多种任务调度场景,有配置简单、稳定、容错等特点,安装也容易。

开源先锋
产品应用7

用 AI Coding 工具生成 60 万字奇幻世界设定的实践记录

作者先尝试用 Python/C# 编排 LLM 调用生成小说世界设定,遇节点信息查看、输出形态等问题。后用 AI Coding CLI,经搭建骨架、基础层展开等阶段生成 60 万字奇幻世界设定,还基于此创作叙事。

机器学习AI算法工程
算法论文8

视频生成太慢?英伟达、谢赛宁等发布TMD框架,实现70倍加速

大规模视频扩散模型采样效率低,应用受限。英伟达联合谢赛宁等提出TMD框架,将大型视频扩散模型蒸馏为少步生成器。实验显示,TMD能实现超70倍加速,质量损失小,用户也更偏好其生成的视频。

机器之心