低秩参数修剪」共找到 1600 篇相关文章

算法论文8

CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning

大型语言模型解决复杂推理问题时效率,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。

深度学习自然语言处理
新闻资讯8

谷歌「最强图像模型」横扫一切!3毛钱P图打懵OpenAI,PS要不存在了

谷歌发布顶级图像模型Gemini 2.5 Flash Image,化身nano - banana在LMArena盲测夺冠。它有四大能力,价格至每张图不到3毛钱,冲击传统P图工具,虽有小瑕疵但应用前景广。

新智元
开源动态8

别养龙虾了,硅谷Agent新潮流是「爱马仕」

免费开源的Hermes Agent上线一个月霸榜GitHub Trending,标星超6.66万。它强调持续学习和自我进化,能自动提炼可复用技能。安装门槛,支持多系统,还原生支持个人微信。

量子位
开源动态8

3.9k星星爆火硬件开源,用Wi-Fi实现室内人体活动检测。

智能家居有诸多需求待解,如家庭安防、老人看护等。ESPectre开源项目用Wi-Fi检测室内人体移动,无需摄像头和红外传感器,配件成本,利用Wi-Fi信道状态信息及高效算法实现功能。

开源AI项目落地
开源动态7

vLLM 正式支持 PaddleOCR-VL

11月4日,vLLM项目宣布正式支持PaddleOCR-VL模型。该模型专注文档解析,参数量仅0.9B。合作降部署门槛,推理效率更高,官方还给出部署指南和配置建议,流程快速完成可作榜样。

AI工程化
8

豆包 AI 编程:一句话写赛博鱼缸,动嘴皮改富士滤镜

豆包发布全新模型 1.6 后,AI 编程更新,基于此模型在评测集位列第一梯队。它实现门槛+可用性,能一句话生成网站、工具,还可可视化编辑,目标是让普通人能做产品。

刘言飞语
算法论文8

ICLR-26腾讯混元:Agent是强大的,但用户是狂野的

现有LLM工具使用基准测试场景理想化,忽视真实用户行为复杂性。腾讯提出WildToolBench,基于真实用户行为构建测试集,对58个模型评估,发现模型准确率,揭示LLM在真实场景下能力缺口,为模型优化指明方向。

PaperAgent
新闻资讯7

谷歌云推出面向毫秒级延迟工作负载的 Rapid Storag

在 Google Cloud Next 2025 大会上,谷歌云推出 Rapid Storage,为频繁访问数据和延迟敏感应用提供毫秒级数据访问,有延迟、高吞吐量等特点,还与亚马逊 S3 Express 被比较,目前处于预览阶段。

InfoQ
算法论文8

谷歌Transformer过时了?清华姚班校友等三连击,爆改注意力!

谷歌提出新架构,参数减少40%,训练速度较RNN提升5 - 8倍,某些任务性能超Transformer 7.2%。新架构引入注意力偏向策略,用「保留」取代「遗忘」,还提出Moneta、Yaad、Memora三个新模型,在多任务上表现卓越。

新智元
产品应用7

The Batch: 964 | Claude 亮相另一款 Opus

Anthropic发布Claude Opus 5,这是款视觉 - 语言模型,运行成本,多任务表现优于Claude Fable 5。它在多项测试中领先,解决了Fable 5的一些问题,但也有易产生幻觉等不足。

DeeplearningAI