两阶段注意力机制」共找到 1640 篇相关文章

新闻资讯7

GitHub Issues 大改造:用缓存和预取,让页面打开快了数倍

GitHub 重新设计 GitHub Issues 导航架构,通过客户端缓存、预测性预取等机制,提升导航性能,使即时导航体验比例从 4%增至 22%,解决大型 Web 应用常见的延迟问题。

InfoQ
产品应用8

三重激励+全周期扶持,即梦升级这个计划,让AI创作者的成长有迹可循

即梦AI创作者成长计划全面升级,构建覆盖三阶段的扶持体系,提供多维资源。该计划通过三重激励机制助创作者增收,还打造优质社区,持续开放至2025年12月。

机器之心
算法论文8

ICLR 2026 Oral | 告别多步去噪!清华团队推出MVP,实现机器人动作单步极速生成

清华大学智能驾驶课题组 iDLab 与加州大学伯克利分校人工智能研究院 BAIR联合发表研究,提出 MVP 策略。它引入瞬时速度约束解决均值流学习问题,设计复合生成与选择机制,在多任务测试中表现出色。

机器之心
算法论文8

CVPR 25 |全面提升视觉感知鲁棒性,生成模型快速赋能三维检测

香港中文大学(深圳)等单位学者提出 DriveGEN 无训练自动驾驶图像可控生成方法,无需额外训练生成模型,通过两阶段策略扩展训练数据,提升三维检测模型鲁棒性,代码已开源。

机器之心
新闻资讯8

ICLR史无前例!中国团队站上C位,全球AI顶会首次为它设专场

ICLR宣布由阿里妈妈牵头的「AI for Mechanism Design and Strategic Decision Making」专题研讨会通过评审,这是其首次设聚焦「机制设计与决策智能」的Workshop,众多大咖参与,连接学术与工业。

新智元
算法论文8

为什么自监督永远学不到语义?

《Visual Language Hypothesis》论文用纤维丛理论审视视觉表征学习,指出只做连续变换难触达语义。分析现有无监督学习不足,提出“Expand - and - Snap”机制,还通过实验验证,提供审视AI架构新视角。

深度学习自然语言处理
产品应用7

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%

小米发布Qwen2.5VL升级版MiMo-VL,能力提升30%。它能完成输入视觉回答问题、做几何体等任务,重点解决多模态推理、视觉理解及与人类偏好对齐问题,介绍了模型结构、训练阶段等内容。

CourseAI
产品应用8

AI 模特时代到来:字节x清华推出商用级视频换装模型DreamVVT,保真度显著领先SOTA

字节跳动智能创作团队联合清华推出视频换装模型DreamVVT,基于Diffusion Transformer构建,用两阶段设计解决复杂场景痛点,支持多种输入,在保真度和时序稳定性上领先SOTA。

机器之心
产品应用8

松下发布多模态大模型,文本、图像、音频随意切换

多模态数据处理成热点,但现有模型处理复杂任务有挑战。松下开发多模态大模型OmniFlow,采用模块化设计、多模态引导机制,实验显示其在多任务中有卓越表现。

AIGC开放社区
开源动态8

视频生成比播放还快:开源VDN-H3,14秒视频11秒搞定

近期,网络出现“无限流”视频,源于MiniMax H3。OpenVDN团队开源Video Delta Net(VDN),基于MiniMax H3使视频生成速度提升75到90倍,14.4秒的768p视频11.23秒就能生成。它采用混合思路,性能提升显著。

AI工程化