低秩参数修剪」共找到 1600 篇相关文章

产品应用8

别让米其林主厨削土豆!英伟达用「小脑指挥大脑」,重构AGI生产力

英伟达推出8B模型Orchestrator,通过组合工具降本增效。在HLE等测试中超越GPT - 5,成本仅为其30%左右。它还能泛化到未见工具,具有可定制调度能力,标志着复合AI新范式的兴起。

新智元
新闻资讯7

Gartner发布生成式AI模型提供商魔力象限

Gartner发布《生成式AI模型提供商创新指南》,首次对生成式AI市场进行象限划分,按功能完整性和未来潜力将厂商分为新兴领导者、新兴挑战者、新兴远见者和新兴专家四个区域,还指出AI正从实验转向企业核心层。

AI工程化
算法论文8

6666!NuerIPS满分论文来了

NuerIPS唯一满分论文结论惊人,指出真正决定推理上限的是基座模型本身而非强化学习,且蒸馏比强化学习更有望实现大模型自我进化,这给正火热的RLVR泼了冷水。

量子位
算法论文7

Zero-RAG,对冗余知识说“不”

文章指出大语言模型知识冗余,RAG 检索效率。复旦大学邱锡鹏提出 Zero - RAG,能精准识别并剪除冗余知识,砍 30%语料准确率掉点小,检索延迟降 22%,还介绍了其技术方案。

PaperAgent
开源动态8

Kimi K2 Thinking,最强思考模型,附实测

Moonshot AI发布Kimi K2 Thinking模型,它能边思考边行动,是目前最强开源思考模型,多项指标超GPT - 5等闭源巨头。其具独特架构,有性能优势,还给出部署方式,实测表现佳。

AGI Hunt
开源动态8

一句话搞定后端?揭秘被 52.1k 开发者选择的 PocketBase:真能让你 0 运维快速上线产品吗?

PocketBase是“把后端打包成一个文件”的开源项目,既可以作为独立的轻量后端服务直接运行,也能作为Go库嵌入到应用中。它能解决团队做MVP等遇到的痛点,有诸多核心功能和技术优势。

小华同学ai
算法论文8

大模型推理学习新范式!ExGRPO框架:从盲目刷题到聪明复盘

上海人工智能实验室等团队提出经验管理和学习框架ExGRPO,能科学管理经验。与传统RLVR方法比,它在不同基准提升性能,尤其复杂推理任务,还揭示滚雪球效应,为模型推理训练提供新思路。

量子位
新闻资讯7

《AI大模型与异构算力融合技术白皮书》正式发布

10月10日,中科算网等联合发布《AI大模型与异构算力融合技术白皮书》,聚焦大模型开发痛点,为开发者提供技术参考。白皮书介绍全球大模型发展概况、应用场景拓展、算力需求与挑战,指出异构算力成主流趋势。

AIGC开放社区
推荐文章8

ChatGPT架构师,刚发布了最新研究成果

Thingking Machines发布第三篇研究博客,核心作者是OpenAI联创John Schulman。研究关于LoRA参数高效微调方法,探究其匹配全量微调效率的条件,给出简化调参方案,还提炼出三个核心发现。

量子位
新闻资讯7

向英伟达发起挑战的 AI 芯片初创公司,估值快五百亿了!

人工智能芯片初创企业 Groq 完成 7.5 亿美元融资,投后估值 69 亿美元。它试图打破英伟达垄断,产品是专用芯片,面向开发者与企业,成本于竞品,创始人技术背景深厚,服务开发者数量增长快。

InfoQ