降本增效」共找到 586 篇相关文章

算法论文8

首次披露!DeepSeek V3 发布软硬一体协同训练论文,公开「」秘诀

DeepSeek团队发布论文《洞察DeepSeek - V3:规模的挑战和对AI架构硬件的思考》,从硬件架构和模型设计双重视角,探索其经济高效的大规模训练和推理方法,介绍了设计原则、低精度驱动等多方面内容及秘诀。

AI科技评论
算法论文8

清华刘知远团队:高质量LLM训练数据获取新方法!成90%,性能大提升

清华刘知远团队论文提出全新数据筛选方案,解决传统数据筛选验证慢、主观性强问题。发明‘半成品加工法’,用fastText筛数据,筛出Ultra - FineWeb数据集,提升模型性能,还计划拓展到专业领域。

深度学习自然语言处理
算法论文8

全新线性注意力范式!哈工深张正团队提出模长感知线性注意力!显存直92.3%!

哈工深张正团队联合多团队发布论文,提出 NaLaFormer 框架,解决线性注意力两大核心缺陷,保持线性复杂度同时精度超越,在多任务表现出色,如超分任务显存 92.3%。

机器之心
新闻资讯7

AI 能耗救星!这个能倒着走的「可逆计算」芯片,将能耗直10倍

最新研究提出可逆芯片,通过让计算「倒着走」,有望将AI能耗直10倍。它基于热力学原理,避免删除数据以减少热量产生。经几十年探索,如今可逆计算或成延续计算进步关键。

AGI Hunt
产品应用7

千万养虾人的终极梦想!全球首个「养虾」带你懒人养虾开箱即食

荣耀发布自研 YOYOClaw 龙虾技术,首发于 MagicBook 系列,开创「养虾」品类。该技术预置龙虾能力,具备自主学习,节省 50% Token,有设备级防护,实现多端共享,推动 AI 产业范式转变。

机器之心
产品应用8

最强编码模型 Fable 5.1 发布:性能翻倍、Agent 成 45%,Anthropic 把顶级模型送进真实世界

当地时间9月1日,Anthropic发布Claude Fable 5.1和Claude Mythos 5.1,新模型在多方面能力提升,Agent工作负载成最高45%,此次发布还涉及价格、数据留存等多方面内容,争夺高价值任务市场。

InfoQ
新闻资讯8

Altman承认“搞砸了”!曝 GPT-5.2 牺牲写作换顶级编程,明年成 100 倍,实锤Agent 已能永久干活

OpenAI CEO Sam Altman 在研讨会上勾勒 GPT-5 进化蓝图,承认 GPT-5.2 研发“搞砸”写作能力,承诺到 2027 年底其智力成 100 倍,还提出未来软件应“随需随生”,重构操作系统。

AI前线
开源动态8

训练效率提升25%、成23%!上海期智研究院、算秩未来联合推出MegatronApp:专为万亿参数大模型训练打造的系统工具包

上海期智研究院联合算秩未来在WAIC 2025大会发布开源项目MegatronApp,它是国内首个围绕Megatron - LM的增强工具链。经实际数据,其在该框架下训练效率提25%、成23%,含四大模块解决训练难题。

AI前线
算法论文8

Transformer可以改装成Mamba了:苹果把推理成直接打成线性

苹果将Transformer改造成Mamba,采用‘两步走’策略,先造中间形态,再转成Mamba,避免性能崩塌。实验显示,新方法性能几乎没掉,成逻辑改变,为模型重构提供新可能。

机器之心
新闻资讯7

老黄大出血!OpenAI背刺英伟达,微软自研芯连夜拆掉CUDA护城河?

2026年1月26日微软官宣第二代自研AI芯片Maia 200上线,还推出软件Triton。它塞满SRAM,推理成更低、效率更高。这让英伟达面临生存危机,AI算力圈也变天,成关键。

新智元