图扩散架构」共找到 2260 篇相关文章

新闻资讯8

“硬核芯科技园”圆满收官:汇聚中国芯硬核力量,勾勒自主创新全景

2025年9月10 - 12日,SEMI - e深圳国际半导体展举行,“硬核芯科技园”特色展区汇聚10家优秀企业,展示全链条创新成果。底层技术突围,企业展示关键芯片与元件;产业生态共建,保障供应链稳定。

芯师爷
算法论文8

谷歌DeepMind曝光首个“AI 经济体”完整架构,Agent催生全新经济体正在悄然成形

谷歌DeepMind论文描绘由AI Agent自主交易和协作的经济体,提出“沙盒经济”框架,分析其起源与隔离程度,指出发展方向及挑战,还给出应用场景、市场机制、设计方案、基础设施层和行动建议。

AI寒武纪
算法论文8

GUI 精准定位新 SoTA:LASER 让模型从“看全”走向“锁重点”

多模态大模型在高分辨率、元素密集的 GUI 场景易误判。苏州大学 OpenNLG 团队提出 LASER 方法,让模型学会主动推理,通过关键区域聚焦等提升定位精度,在基准测试中表现出色。

深度学习自然语言处理
产品应用8

拯救P废柴,阿里上新多模态模型Qwen-VLo!人人免费可玩

昨夜阿里推出全新多模态模型Qwen-VLo,在原有能力上全面升级,有细节捕捉、像编辑、多语言支持等亮点,不受固定格式限制。官方demo展示多种玩法,目前免费可玩,实测其编辑能力不错。

量子位
新闻资讯7

首次曝光!OpenAI新一代旗舰Astra换上“循环深度”推理架构:用计算深度换参数规模

9月2日消息,OpenAI将推出的旗舰模型Astra采用“循环深度”新技术,用较小模型实现庞大模型性能,降低成本。但该技术会让AI推理过程不可读,加重安全担忧,此前奥特曼已因Astra“能力过强”踩刹车。

AI前线
算法论文8

CVPR 2026|1分钟单变4D视频!AI看直接脑补物理规律

北京理工大学和理想汽车等团队提出全新框架PhysGM,引入DPO实现端到端快速前馈推理,能1分钟内将单生成为4D动态视频,在速度和评价指标上超越主流模型,相关工作被CVPR 2026接收且代码已开源。

机器之心
产品应用8

腾讯用AI把美术管线重新做了一遍,混元3D Studio架构曝光

腾讯推出专业级AI工作台混元3D Studio,可覆盖3D资产生产全流程,让生产周期大幅缩短。它有组件拆分、可控像生成等七大核心技术模块,各模块对应关键阶段,实现无缝衔接与自动化。

量子位
产品应用7

支付宝 AI 出行助手高效研发指南:4 人团队的架构迁移与提效实战

本文介绍支付宝AI出行助手研发历程,其集成多种出行功能,基于xUI + KMP框架搭建。分享研发实践、挑战与策略,如迁移基础能力、卡片生态,适配标准框架,还提及KMP应用及数据度量体系,取得业务和研发效能成果。

阿里云开发者
算法论文8

真实场景也能批量造「险」!VLM+扩散模型打造真实域自动驾驶极限测试

浙江大学与哈工大(深圳)联合推出SafeMVDrive,将VLM关键车辆选择器与两阶段轨迹生成结合,可在真实域批量制造高保真安全关键视频,用于端到端自动驾驶系统安全性测试。

新智元
产品应用7

生视频新玩法刷爆外网:上画两笔就能动起来,终于告别文本提示

Higgsfield AI 是专注 AI 视频生成的初创公司,近期发布 Draw-to-Video 和 Product-to-Video 功能,前者画形元素就能生成视频,后者可拖拽生成广告视频。它还常上新功能、集成热门模型,官网功能模板丰富。

机器之心