「双层生成架构」共找到 3885 篇相关文章
可灵3.0系列模型正式上线:属于每个人的导演时代来临
可灵AI正式全球上线3.0系列模型,覆盖影视级全流程链路。该系列基于All-in-One理念构建,解决了行业一致性等问题,在多方面做了增强,完成从单点生成到专业调度的跃迁,让AI成创作协作者。
字节悄咪咪上线了 AI 版抖音「随变」,在下什么棋?
临近春节,字节跳动 1 月初上线的「随变」App 在年轻人中流行。它类似「纯净版」AI 抖音,核心功能有 AI 形象生成等。字节借此在小体量社区验证功能,解决抖音年轻用户留存问题,也想抢占 AI 视频市场。
对话蚂蚁灵波首席科学家沈宇军:2万小时真机数据,用“慢功夫”做具身智能|甲子光年
蚂蚁灵波首席科学家沈宇军接受专访,称具身智能处于‘GPT - 1时刻’。团队选‘慢’路,积累2万小时真机数据,发布四个具身智能模型并开源。介绍模型架构、优势、问题及未来计划,还谈了开源考量等内容。
阿里开源Qwen3-Coder-Next,80B参数仅激活3B的MoE顶尖编程助手
阿里开源小型MoE代码模型Qwen3 - Coder - Next,总参数量800亿但仅激活30亿参数,在代码生成等任务表现出色。团队构建训练技术栈解决数据匮乏,模型训练分阶段,多领域专家模型能力整合,基准测试性能强劲。
BJIFF·电影+|第十六届北京国际电影节AIGC电影单元征片公告
第十六届北京国际电影节AIGC电影单元开启征片,该单元已成长为全球关注的AI电影创作新阵地。介绍了组织架构、征集时间与范围、作品要求、荣誉设置等,还设有活动福利,致力于打造全球AI影视创新平台。
DeepSeek-OCR 2再进化,对图像理解已经像人一样逻辑推理了
DeepSeek-OCR 2升级,保持前代高效压缩率和解码效率,引入DeepEncoder V2,模仿人类视觉因果流机制,将图像理解转为逻辑推理,在文档解析领域实现逻辑重构,性能显著提升。
跨境电商版Sora发布:全球首个AI原生电商视频Multi-Agent来了
营赛AI发布跨境电商版Sora——inSai Hilight。它无需拍摄素材与复杂提示词,扔个商品链接或图,20 - 30分钟就能生成逻辑严密、商品还原度100%、符合TikTok爆款节奏的营销视频,重新定义电商营销视频生产方式。
DeepSeek连发两篇论文背后,原来藏着一场学术接力
2026年1月,DeepSeek连发两篇论文,一篇解决信息稳定流动,另一篇聚焦知识高效检索。研究发现其与字节Seed团队存在“接力”,如mHC改进字节Seed的HC,Conditional Memory引用多项工作,梳理关系能助理解论文与架构创新方向。
NeurIPS 2025|指哪打哪,可控对抗样本生成器来了!
近日,清华大学和蚂蚁数科在NeurIPS上联合提出Dual - Flow新型对抗攻击生成框架。它能从海量图像数据学“通用扰动规律”,对多模型、多类别发起黑盒攻击,为AI安全带来挑战,已用于蚂蚁数科产品。
5张 H800 带来 20 FPS 高保真实时虚拟人生成
传统扩散模型做视频生成速度慢、画面不稳定,难用于实时虚拟人场景。阿里Live Avatar框架将算法和系统一起设计,用TPP并行推理策略和RSFM机制等,5张H800 GPU能实现20 FPS高保真实时虚拟人生成。