全注意力残差」共找到 2020 篇相关文章

算法论文7

引入小目标注意力模块改进YOLO12用于无人机视角下的岸边人员玩水检测

文章介绍用小目标注意力模块改进YOLO12,用于无人机视角下岸边人员玩水检测。先介绍YOLO12特点与结构,再说明小目标注意力模块CBAM优势、流程及代码,接着阐述改进方法、数据集情况,最后给出训练和测试模型的代码与结果。

机器学习AI算法工程
开源动态8

AI 真能看懂物理世界吗?FysicsWorld:填补模态交互与物理感知评测的空白

多模态大语言模型正经历范式转变,目标是实现模态协同交互。但现有评测体系难跟上模型发展。飞捷科思和复旦团队推出 FysicsWorld 基准,可评测模型多能力,还提出 CMCS 策略,为模态智能发展提供指引。

机器之心
产品应用7

15岁进少年班,97后打造「元点机器人宇宙」:栈技术自研领跑家庭机器人赛道

元点Zeroth发布尺寸人形Jupiter和异构机械臂家庭协作机器人N1,强调与人类长期共生关系。其创始人是97年的郭人杰,公司已累计融10亿。元点有栈技术体系,走渐进式落地路线。

新智元
推荐文章8

AI Coding 之后,如何让 Agent 进入企业研发链路?得物推荐的 Harness 实践

得物资深技术专家白忠魏在AICon大会分享实践。团队目标是将AI Coding扩展为链路方法,介绍了PDCA循环、链路前提、七阶段护栏等探索,还提及用知识体系和混合Agent架构解决问题,已有阶段性成果。

InfoQ
开源动态8

长上下文快2.9倍,解码快6倍:Kimi 用线性注意力实现性能与效率双突破

月之暗面团队的Kimi Linear模型,是混合线性注意力架构,核心是Kimi Delta Attention模块。它解决线性注意力的记忆及遗忘问题,在多任务测试表现出色,还开源相关资源,推动高效长上下文模型研究。

AIGC开放社区
新闻资讯8

Gemini 首次反超 ChatGPT,谷歌CEO劈柴哥复盘:不止是十年算力与栈豪赌,更是找回了“老谷歌”那个味儿

截至2025年底,Gemini在桌面和移动网页端单次使用平均停留时长超ChatGPT,下载量也快速追赶。谷歌CEO Sundar Pichai称这是栈投入成果,还提及早期谷歌文化回流,也谈到未来十年押注等内容。

InfoQ
算法论文7

JCP | 浙江大学边鑫等:基于 PINNs 的非结构自适应网格细化:面向稳态流动的差驱动 AMR 新方法

本文提出利用控制方程差引导网格细化的启发式策略,用物理信息神经网络(PINNs)整合粗网格数据与控制方程。通过解决流动问题并与传统方法对比,显示该策略能平衡计算精度与成本,但有额外计算开销。

力学与人工智能
新闻资讯7

阿里云容器服务覆盖AI流程,团队透露:OpenAI训练GPT时就用了我们的开源能力

拿下中国AI云市场第一后,阿里云技术产品负责人开展AI Infra分享会。其栈云计算搭好技术架子,10万GPU集群高效互联,容器服务贯穿AI流程,还透露OpenAI训练GPT时用了其开源能力。

量子位
新闻资讯8

爆发力超越波士顿动力液压机器人,PHYBOT M1实现球首次尺寸重型电驱人形机器人完美拟人态后空翻

动易科技的尺寸人形机器人PHYBOT M1实现球首次尺寸重型电驱机器人完美拟人态后空翻,其爆发力超波士顿动力Atlas。这是对其动态性能的压力测试,电驱系统也在多方面超越液压方案。

量子位
新闻资讯8

Gemini 首次反超 ChatGPT,谷歌CEO劈柴哥复盘:不止是十年算力与栈豪赌,更是找回了“老谷歌”那个味儿

截至2025年底,Gemini在桌面和移动端单次使用平均停留时长首超ChatGPT,下载量也快速追赶。谷歌将其嵌入自家生态策略见效,这与Gemini 3推出有关,还体现了栈能力与早期谷歌文化回流。

AI前线