自适应提前观测」共找到 282 篇相关文章

开源动态8

刚刚,DeepSeek 突发梁文锋署名新论文:V4 新架构提前曝光?

今天凌晨,DeepSeek在GitHub开源新论文与模块Engram,论文提出“查—算分离”机制,通过可扩展查找记忆结构提升模型表现。Engram将记忆与计算职责分离,或成V4核心技术,获网友肯定。

InfoQ
产品应用7

容器可观测新视角: SysOM延时监控助力定位业务抖动原因

云原生场景下,资源超卖和混合部署使宿主机与容器化应用资源竞争加剧,引发内核级延迟问题。本文结合实战案例,介绍用ack - sysom - monitor Exporter分析定位内核延迟,还介绍了SysOM监控及解决系统延时的方法。

阿里云开发者
算法论文8

扩散LLM推理新范式:打破生成长度限制,实现动态自适应调节

随着扩散大语言模型成为热门,但其推理时存在预设固定长度的限制。香港中文大学 MMLab 等提出 DAEDAL,赋予模型根据问题自主调整回答长度的能力,在性能和计算效率上有提升。

机器之心
算法论文8

静态稀疏已死:Flux Attention 开启长文本 LLM 自适应推理新时代

文章指出长上下文LLM高效推理面临性能与效率难题,先介绍Elastic Attention打破静态稀疏桎梏,后重点阐述全新的Flux Attention,它将动态稀疏注意力范式升级为层级别路由,解决了算法与硬件的矛盾,在多方面实现突破。

深度学习自然语言处理
新闻资讯8

英伟达All in的物理AI路线,居然是中国黑马提前一年就定义好了

全球具身智能行业为技术路线争论时,中国深度机智率先提出并跑通「人类学习」路线,以人类数据为起点、动作建模为中心、机器人为AI而生,英伟达等跟进,深度机智全栈落地且进度领先。

新智元
算法论文8

DeepSeek开源大模型记忆模块!梁文锋署名新论文,下一代稀疏模型提前剧透

DeepSeek最新论文给Transformer加上“条件记忆”,补上原生知识查找机制。梁文锋署名,与北大团队合作。提出全新范式及Engram模块,解决传统N - gram问题,研究稀疏性分配,验证推理能力提升,兼顾工程优化。

量子位
算法论文8

首个地球科学智能体Earth-Agent来了,解锁地球观测数据分析新范式

上海人工智能实验室与中山大学联合研发的 Earth - Agent 解决了多模态大语言模型用于地球科学研究的痛点。它将领域知识工具封装化,利用 LLM 智能规划调度。经 Earth - Bench 评估,其在多方面表现出色,未来发展前景广阔。

机器之心
算法论文8

极端天气也不怕漏检!RDA-YOLO:面向微小绝缘子缺陷检测的鲁棒动态自适应网络

文章指出传统绝缘子检测方法面临人工巡检效率低、小目标检测难等挑战,现有YOLO系列算法也有局限。为此提出RDA - YOLO网络,在YOLOv8基础上有三项创新,实验显示其精度、速度和极端天气鲁棒性表现出色。

机器学习AI算法工程
新闻资讯7

星火燃动海淀!投海Tech Show即将登场,提前解锁创新「星火」档案|甲子光年

4月23日投海Tech Show将在海淀启幕,拒绝形式主义,以真实内容和沉浸式体验展示前沿科技。众多创业者携项目而来,涵盖AI、硬科技等领域,现场还有互动环节,选出最“夯”项目。

甲子光年
新闻资讯7

让记忆学会“进化”:探索 LLM Agent 的运行时价值感知与自适应检索 | 直播预约

本次直播将介绍最新研究成果 MemRL,提出作用于情景记忆的运行时强化学习方法,使 LLM Agent 能判断记忆价值,检索高价值经验,提升复杂未知环境下泛化性能与任务成功率。

深度学习自然语言处理