「能力实现率(CRR)」共找到 4904 篇相关文章
东方理工团队提出HiDrop:重构MLLM计算路径,压缩90%视觉Token实现2.2倍加速
东方理工大学沈晓宇团队提出HiDrop,基于MLLM不同层功能差异,设计出延迟注入、凹金字塔式剪枝和提前退出的视觉Token压缩策略。实验显示,它能压缩约90%视觉Token,保持98.3%性能,实现训练和预填充加速。
英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限
学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。
快慢思考不用二选一!华为开源7B模型实现自由切,精度不变思维链减近50%
华为发布openPangu-Embedded-7B-v1.1,参数7B却有双重“思维引擎”。采用渐进式微调策略和快慢思考自适应模式,可自由切换快慢思考,在多评测中精度提升,思维链减近50%。还推出openPangu-Embedded-1B小模型。
抗干扰能力提升近40% !无需对抗训练,北航上海AI Lab新蒸馏方法提升模型鲁棒性 | ICML 2025
在人工智能模型规模持续扩大的今天,数据集蒸馏方法能提升训练效率、降低成本,但蒸馏模型在安全性要求高的任务中抗干扰难。北航上海AI Lab团队提出ROME方法,无需对抗训练,显著提升模型鲁棒性,成果被ICML 2025接收且已开源。
Anthropic宣布练出神话级模型:Claude Mythos,代码和黑客能力吊打opus4.6,不向公众开放!
Anthropic宣布Project Glasswing计划,因训练出超强模型Claude Mythos Preview。该模型代码和推理能力超opus 4.6,扫描主流软件发现数千零日漏洞。此模型不向公众开放,计划先在Claude Opus验证安全机制。
我拥有了超能力!Meta最牛文科生让3个AI互掐,竟造出1人技术部
Meta产品经理Zevi Arnovitz零技术基础,借助Cursor和Claude治愈代码恐惧。他分享经历,用管理团队方式管理AI,建立开发流,还让AI互审代码。AI正让普通人构建未来,职场需全能构建者。
12毫秒暴露自动驾驶致命缺陷,北航新研究实现场景感知的动态物理对抗攻击|TPAMI2025
近日部分L3级自动驾驶车型获批上路,但自动驾驶感知系统存在缺陷。北航等机构提出DynamicPAE框架,实现场景感知的动态物理对抗攻击,解决多维度挑战,在多场景表现优异,被TPAMI2025录用。
当人形机器人还在画饼,这家公司已用“带大脑的机械臂”实现批量落地 | 甲子光年
当资本热捧人形机器人时,微亿智造已率先将工业具身智能规模化落地。其‘创TRON’机器人解决多行业痛点,实现降本增效,落地版图不断扩大,还构建技术护城河,未来将迈向群体智能。
超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破
文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。
谷歌 Cloud AI 总监 14 年血泪复盘:AI 时代工程师不可替代的 5 类能力,代码反而排在最后
谷歌 Cloud AI 总监 Addy Osmani 复盘 14 年谷歌职场,指出在大厂代码非决定工程师发展的关键,分享 21 条心得,如用户至上、携手求真等,助工程师少走弯路。