并行循环Transformer」共找到 616 篇相关文章

新闻资讯8

OpenAI资深研究科学家、Transformer联合作者Łukasz Kaiser领衔,2026 奇点智能大会·北京站正式官宣

2026年,Sam Altman等四位AI界大佬称已进入奇点。11月20 - 21日,奇点智能大会北京站将举行,两大核心会议同期举办。OpenAI资深科学家Łukasz Kaiser将演讲,会议汇聚专家探讨AI前沿与底层技术。

AI科技大本营
算法论文8

空间智能新高度:港科大谭平团队SAIL-Recon突破万帧级图像大规模3D场景重建Transformer

香港科技大学谭平教授团队与地平线团队发布3D场景表征与大规模重建新方法SAIL - Recon,突破现有模型处理能力瓶颈,可实现万帧级场景表征抽取与定位重建,在多数据集上表现优于现有方法。

机器之心
算法论文7

AI顶会模式出了问题? 「不发表,就出局」的恶性循环,正在压垮整个AI学界

随着AI领域发展,NeurIPS等大型学术会议愈发热门,但也带来诸多问题,如发表激增、碳排放过载、研究与会议脱节等。新加坡国立大学团队研究后指出传统模式弊端,并提出社区联合型会议新模式。

机器之心
算法论文8

ICML2025|宁波东方理工大学刘野,陈云天:DragSolver:用于真实汽车风阻系数估计的多尺度Transformer方法

当汽车高速行驶,空气阻力影响车辆性能。传统风阻系数测算方法耗时久,难以满足实际需求。宁波东方理工大学等机构研究者提出DragSolver模型,能快速准确估计风阻系数,经实验验证效果优,有降本增效等价值。

力学与人工智能
开源动态8

告别Transformer!北大、北邮、华为开源纯卷积DiC:3x3卷积实现SOTA性能,比DiT快5倍!

北大、北邮和华为研究提出纯卷积扩散模型 DiC,抛弃自注意力机制回归 3x3 卷积。它性能超 DiT,推理速度快 5 倍,证明精心设计的卷积网络在生成任务中也能表现卓越。

机器之心
新闻资讯7

Qwen最新3.7 Max预览版空降!两代超大杯并行迭代,林俊旸走了但还在加速

Arena公布Qwen3.7-Max-Preview和Qwen3.7-Plus-Preview成绩,文本和视觉领域均为国产第一。Qwen3及以后迭代提速,大版本间隔缩至2-3个月,反映阿里Qwen团队进入快速实验、高频交付阶段。

量子位
算法论文8

训练提速4.6倍!FP4+BF16双轨并行,NVIDIA×港大×MIT联手重新定义扩散模型训练速度上限

NVIDIA、港大、MIT团队提出Sol - RL,采用「FP4先探索、BF16再训练」框架,将扩散模型训练收敛速度最高提至4.64x,在速度与对齐效果间给出工程可行解法。

机器之心
算法论文8

AST | 西工大崔榕峰、张伟伟等:基于物理约束与双并行注意力UNet++的高保真度三维机翼流场重构研究

本文针对三维机翼流场重构难题,提出DPAtt - UNet++框架,融合几何隐式编码、多尺度注意力与物理规律约束。实验表明,其重构精度高,预测速度较CFD提升2 - 3个数量级,为飞行器气动分析提供新路径。

力学与人工智能
开源动态8

创智刘鹏飞、Sand.ai曹越,两大AI青年学者团队联手,开源音视频基座模型

开源多模态生成领域获架构级底层突破。上海创智学院与 Sand.ai 联合研发的 daVinci - MagiHuman 正式开源,打破开源界音视频联合同步生成三重局限。它采用单流 Transformer 架构,能力强、推理效率高。

机器之心
开源动态7

Cloudflare 如何解决了 quiche 中的一个拥塞漏洞

Cloudflare 分享发现 CUBIC 的 Rust 实现问题,该问题影响开源库 quiche。团队构建模拟环境测试,发现 CUBIC 陷入恢复循环,用 Reno 测试排除广泛问题,最终一行代码修复,使测试通过率达 100%。

InfoQ