全注意力机制」共找到 2720 篇相关文章

算法论文8

谷歌Transformer过时了?清华姚班校友等三连击,爆改注意力

谷歌提出新架构,参数减少40%,训练速度较RNN提升5 - 8倍,某些任务性能超Transformer 7.2%。新架构引入注意力偏向策略,用「保留」取代「遗忘」,还提出Moneta、Yaad、Memora三个新模型,在多任务上表现卓越。

新智元
算法论文8

首次!世界模型、动作模型融合,自回归模型WorldVLA来了

阿里巴巴达摩院提出自回归模型 WorldVLA,首次融合世界模型与动作模型,统一文本、图片、动作理解和生成。它用独立编码器处理多模态数据,还提出策略解决误差累积问题,实验表现优异。

机器之心
产品应用7

已量产交付!芯桥半导体栈国产GPU助推智算自主化

芯桥(北京)半导体成立于2025年3月,掌握核心自主知识产权,旗下Sinexus X200及Sinexus S200已量产,产品在多算力集群点亮。X200性能强、价格优,芯桥还提供栈式解决方案。

芯师爷
开源动态7

12.6k,谷歌这个开源项目炸了,栈AI Agent

谷歌开源的Gemini Fullstack LangGraph Quickstart项目两周冲到12.6k star。它是使用React前端和LangGraph驱动后端Agent的栈应用程序,能对用户查询做面研究,有多项特征及明确的后端工作步骤。

PaperAgent
新闻资讯8

没有科优秀,具身模型别想进入百万小时

文章介绍权威评测 RoboDojo,给球机器人模型办‘高考’,多数具身模型离落地远。原力灵机的 DM0.5 模型登顶,它记忆能力强、科优秀,且面开源,有望推动具身智能发展。

AI科技评论
新闻资讯8

从Token到词元:模态时代的基模与交互入口

2026年3月24日国家数据局确立“词元”为Token标准译名,Token生成与消耗方式在多模态场景正发生变化。模思智能获数亿融资,探索从语音到模态的路径,成果颇丰且完成能力闭环,其发展受关注。

量子位
新闻资讯8

从「偶然发现」走向「必然创造」:AI如何重塑生物制造链路?

2026年1月9日“第四届合成生物学及生物制造大会”上,深圳瑞德林李加忠指出AI4S驱动合成生物学变革,从“经验驱动”变为“数据与逻辑驱动”,并分享瑞德林通过AI4S重塑生物制造链路的实践。

AI科技评论
算法论文8

挖掘注意力中的运动线索:无需训练,解锁4D场景重建能力

香港科技大学(广州)与地平线团队提出VGGT4D,通过分析VGGT内部机制,利用注意力层运动线索,提出无需训练框架,在动态物体分割等任务表现优异,为低成本4D重建提供新思路。

量子位
新闻资讯8

让AI自己设计芯片!中国科学院发布「启蒙」,芯片流程自动设计

近日,中科院计算所联合软件所推出「启蒙」系统,基于AI实现处理器芯片软硬件流程自动设计,达到或部分超越人类专家水平。该系统在多方面表现出色,如设计的CPU达ARM Cortex A53性能等。

新智元
产品应用7

DeepSeek识图模式量上线,却认不出自家老板梁文锋

端午节前,DeepSeek量推送识图模式。测试发现,它能认出黄仁勋,但忽略‘豆汁’字样,识别人物和潦草汉字准确率低,不过识别文物能力不错。还比较了与其他模型在乐理推理测试中的表现,开发者有新疑问待解答。

机器之心