推理参数」共找到 2566 篇相关文章

算法论文8

NUS LV Lab新作|FeRA:基于「频域能量」动态路由,打破扩散模型微调的静态瓶颈

在大模型时代,参数高效微调(PEFT)已成为迁移大规模扩散模型至下游任务的标准范式。但现有微调方法多采用「静态」策略,忽略扩散生成过程内在规律。新加坡国立大学LV Lab等机构提出FeRA框架,通过频域能量动态路由,实现高效微调。

机器之心
新闻资讯7

OpenAI自研芯片270天光速成功!谷歌TPU大将主导,老黄一夜大客户变对手

OpenAI发布自研推理加速芯片Jalapeño,与博通和Celestica合作打造,专为大模型优化,9个月就流片。操刀者是前谷歌TPU核心成员Richard Ho,计划2026年底部署。此前谷歌、微软等已自研芯片,英伟达客户变对手。

量子位
算法论文8

RAG新SOTA,还在5亿条数据上跑进秒级,只有它了

本文围绕RAG技术展开,指出传统RAG在多跳推理等方面存在局限。介绍了GraphRAG、HippoRAG 2的优缺点,重点阐述Zleap AI的SAG方案,它用超边结构重构数据底座,在多跳问答测试中表现出色,还能在大规模数据下低延迟落地。

机器之心
推荐文章7

AI终点不是算法,而是业务成果 | 云徙科技@MEET2026

大模型时代,基础模型参数规模不断增大,但企业核心业务中AI真实渗透率低。云徙科技执行总裁毛健认为,AI终点是业务成果,应是‘运营×AI’,还指出AI跃迁为业务主体面临四重鸿沟,云徙科技提出破局方法并分享落地案例。

量子位
产品应用3

小美Agent:当龙猫遇到美团外卖的灾难现场

作者体验美团AI助手“小美”后吐槽不断。美团称其用有5600亿参数的龙猫大模型,能力接近GPT - 4o,但它理解需求差、操作订单无效、定位混乱。美团做AI是为跟风,未解决用户真需求,是资源浪费。

AI产品黄叔
算法论文8

只需一次指令微调,大模型变身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral

预训练大模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙大与Thomson Reuters团队提出SIMoE,单阶段微调就能升级大模型,还解决传统方法两大局限,在性能和效率上双突破。

量子位
推荐文章8

刚刚!北大校友Lilian Weng最新博客来了:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。

机器之心
推荐文章9

GPT-6数学封神,遭顶尖数学家公开质疑“算力截胡”?OpenAI内部研究员撕开Astra真相:人脑更容易被污染,而AI只看概率

OpenAI推出GPT-6 Astra,接连在埃尔德什单位距离猜想、纳维-斯托克斯方程等多个顶级数学难题上取得突破性进展,引发顶尖数学家对学术伦理与传统研究模式的争议,本文为OpenAI内部研究员的深度对谈编译,拆解AI数学推理的核心逻辑。

AI科技大本营
新闻资讯7

突发!Fable 5.1遭黑客破解,27万字提示词泄露

Fable 5.1和Mythos 5.1发布,Fable 5.1推理成本低32%。但发布几小时后被破解,27万字提示词泄露,曝光了其安全限制、隐私保护等秘密。它工具增加,还破解密码、能完成多种任务,不过也有用户抱怨耗token等问题。

新智元
推荐文章8

国内第一视角数据最早押注者,北大卢宗青:隐空间才是具身的路

北大卢宗青是国内第一视角数据最早押注者和隐空间路线推进者。他认为人类视频是具身智能唯一可规模化的数据路径,创立BeingBeyond走隐空间世界动作模型路线,成本低、推理快,还发布全球首个隐式触觉世界动作模型Being - H0.8。

AI科技评论