「分块式跨模态融合机制」共找到 532 篇相关文章
2025元宇宙大赛获奖作品公布|“交互幻境”创意赛
2025年第三届元宇宙设计创意大赛“交互幻境”创意赛获奖作品公布。赛事3月启动,获上海工会支持,征集全球3148份作品。赛事探索元宇宙与现实融合,推动多领域数字化转型,下面介绍了各奖项获奖作品。
上海AI Lab发布混合扩散语言模型SDAR:首个突破6600 tgs的开源扩散语言模型
上海人工智能实验室提出全新范式SDAR,通过‘训练 - 推理解耦’融合AR模型高性能与扩散模型并行推理优势。实验证明,SDAR性能与原版AR模型持平或超越,还能加速推理,且已全面开源全系列模型。
量化噪声竟是RL秘钥?QeRL:高效强化学习新范式,一场噪声引发的性能革命
近年来,大语言模型在复杂推理任务中面临挑战,强化学习虽更接近人类推理过程,但训练“烧资源”。论文《QeRL》提出量化不仅能压缩模型、节省资源,还能增强模型探索能力,QeRL框架实现训练速度提升、内存占用减半。
Cluely:最具争议的 00 后 AI 创业者,用一款 “作弊神器”2 个月实现 600 万美金 ARR
本文编译自 a16z 与 Cluely 联合创始人兼 CEO Roy Lee 的对话。Roy 分享了 Cluely 的发展路径,它前身是作弊插件,后成 AI 助手平台,靠病毒营销 2 个月实现 600 万美金 ARR,虽有争议但潜力大。
对话智源王仲远:具身智能“小组赛”才刚刚开打,机器人需要“安卓”而非 iOS
智源研究院院长王仲远在对话中指出大语言模型发展遇瓶颈,AI 需走向物理世界。智源推出“悟界”系列,试图打破具身智能“循环悖论”,做具身智能的“安卓”,还提出大小脑协同策略,认为具身智能“小组赛”未结束。
科大讯飞研发总监王磊磊将在 AICon 上海分享多模态降噪技术的实践与应用
5月23 - 24日AICon上海大会将聚焦AI前沿与产业落地。科大讯飞王磊磊将分享《复杂场景下的语音交互,多模态降噪技术的实践与应用》,介绍基于多模态融合的降噪技术体系及其在智能硬件中的应用。
你要做旁观者,还是定义者?中关村两院全球寻找「AI时代架构师」
中关村两院(北京中关村学院与中关村人工智能研究院)一体两院、融合发展,现全球招募AI时代架构师,包括领军人才、青年科学家、应届博士/博后等,介绍了招聘方向及优厚待遇,还将召开人才闭门交流会。
北大团队改造DeepSeek注意力,速度快四倍还不丢精度
北大张牧涵团队提出新稀疏注意力机制HISA,突破64K上下文索引瓶颈,相比DSA提速2 - 4倍,且不丢精度、即插即用。该机制分块级粗过滤和块内精挑字符两步,实测表现亮眼,也指出后续改进方向。
AST | 西工大崔榕峰、张伟伟等:基于物理约束与双并行注意力UNet++的高保真度三维机翼流场重构研究
本文针对三维机翼流场重构难题,提出DPAtt - UNet++框架,融合几何隐式编码、多尺度注意力与物理规律约束。实验表明,其重构精度高,预测速度较CFD提升2 - 3个数量级,为飞行器气动分析提供新路径。
连OpenAI都在偷偷重仓!大模型的下一站,是「入侵」人类大脑
AI巨头入局使脑机接口升温,格式塔科技获1.5亿融资刷新中国纪录。全球超声赛道投资热,OpenAI等参与。超声波路径优势多,格式塔聚焦医疗,产品有望落地,AI融合是关键,未来脑机接口或成基础设施。