复杂任务生成」共找到 4304 篇相关文章

开源动态8

全新稀疏注意力优化!腾讯最新超轻量视频生成模型HunyuanVideo 1.5核心技术解密

腾讯混元大模型团队发布并开源轻量级视频生成模型HunyuanVideo 1.5,参数8.3B,支持5 - 10秒高清视频生成。它通过多层次技术创新,在生成效果、性能与尺寸上实现平衡,还具备多种核心能力。

量子位
算法论文8

一个md文件收获超400 star,这份综述分四大范式全面解析了3D场景生成

南洋理工大学研究者发表《3D Scene Generation: A Survey》综述,系统归纳300+篇论文,将3D场景生成方法分四大范式解析,还总结应用,探讨挑战与未来方向,如保真度提升、引入物理约束等。

机器之心
推荐文章8

95 后团队做 3D 大模型,拿下头部游戏重磅合作,正在定义 3D 生成的新规则

影眸科技年轻团队携 3D 生成模型 Rodin 获头部游戏合作。其研究入选 SIGGRAPH 最佳论文提名,还完成融资。新模型 Rodin Gen - 2 提升生成质量与可控性,在多领域应用,定义 3D 生成新规则。

Founder Park
产品应用8

V0做不到、Bolt搞不定,Youware用MCP一键解决网页生成最大难题

Youware可快速将AI生成网页部署到线上。其更新后支持调用MCP生成网页,深度适配主流MCP服务,使用门槛低且免费。还上线积分系统,首页分类筛选更详细,作品页增随机按钮。用案例展示了其强大的网页生成能力。

歸藏的AI工具箱
算法论文8

让AI像人类画家一样边画边想,港中文&美团让模型「走一步看一步」

在文生图和视频生成领域,现有模型处理复杂任务常出错。港中文和美团团队提出TwiG范式,将视觉生成拆解为“生成-思考-再生成”循环,经实验验证有效,有望拓展到更多领域。

量子位
算法论文8

NeurIPS 2025 | 北大联合小红书提出Uni-Instruct:ImageNet单步生图FID进入1.0时代!

北大联合小红书提出的 Uni - Instruct 框架被 NeurIPS 2025 接收,它统一超 10 种单步扩散模型蒸馏方法,在多项任务达最佳性能,还能用于文本到 3D 生成

机器之心
产品应用7

10分钟搞定Excel世锦赛难题!首个超越人类Excel Agent,网友:想给它磕一个

Shortcut号称是「第一个超越人类的Excel Agent」,能在约10分钟解决Excel世界锦标赛复杂案例,准确率超80%,还能处理金融建模等任务。但它有格式化懒、多轮对话不佳等局限,目前处早期预览阶段。

机器之心
开源动态7

从科学论文自动生成视频

该项目解决学术演示两核心问题,用智能体PaperTalker生成视频,还设Paper2Video基准评估。介绍了PaperTalker使用步骤,含环境、配置、推理,也说明了Paper2Video评估指标及运行方法。

GitHubStore
产品应用8

谷歌最强AI图像模型Nano Banana 100+精选案例,商业级 AI 创意图集!附高清Prompt

Awesome-Nano-Banana-images收集Nano-banana在各任务场景生成的惊艳图片与提示词,展示Google图像生成与编辑无限可能。文中列举插画变手办、根据地图箭头生成图片等110个案例及对应输入和提示词。

AI Reading Hub
算法论文8

破解AI对不同上下⽂位置的敏感度不⼀致,新框架使出“解铃还须系铃人”

语言模型存在位置偏见,影响复杂推理等任务。论文提出Pos2Distill框架,将模型优势位置能力迁移到劣势位置缓解偏差,设计了Pos2Distill - R1和Pos2Distill - R2,在检索和推理任务表现好且有跨任务泛化能力。

量子位