「模型成本」共找到 8579 篇相关文章

推荐文章8

刚刚,翁荔博客上新:谨慎对待Scaling Law

翁荔新作《谨慎对待 Scaling Law》上线,文章涵盖 Scaling Law 预测内容、计算最优分配原理等。介绍了早期对机器学习损失可预测性的研究,还对比了 Kaplan 等人与 Chinchilla 的 Scaling Law,分析了两者分歧原因。

机器之心
推荐文章8

为什么最有价值的AI讨论总发生在知乎?

AI成全民话题,但网上多是热点复述,真正有价值的理解和方法论沉淀在知乎。知乎答主toyama nao、德里克文、Jeff Tao陶建辉分别作为记录者、探索者和建设者,在AI领域深度探索,推动认知沉淀。

量子位
算法论文8

分享2篇最新Harness论文,一篇谷歌,一篇微软

在LLM Agent迅速发展的当下,如何为其设计合适的Harness成关键问题。本文分享微软M⋆和谷歌AutoHarness两篇论文,分别从记忆系统和动作约束维度提出自动化的Harness进化方法,并介绍了实验结果。

PaperAgent
开源动态7

NotebookLM 平替来了:开源自托管的 Open Notebook,把资料留在自己电脑里

Open Notebook 是开源自托管项目,是 NotebookLM 平替。它解决了资料隐私、模型选择、可扩展性问题,有多种实用功能,提供两种 5 分钟上手方式,适合资料敏感、折腾模型及程序员等人群。

小华同学ai
产品应用7

一致性对标Nano Banana,国产Vidu Q1同时支持7张参考 | 实测

AI生图赛道竞争激烈,专注视频大模型的Vidu推出Q1参考生图模型,能同时支持7张参考图,主体一致性对标谷歌Nano Banana。实测玩法多样,有高可操作性,现已全球同步上线。

量子位
新闻资讯7

AI 能耗救星!这个能倒着走的「可逆计算」芯片,将能耗直降10倍

最新研究提出可逆芯片,通过让计算「倒着走」,有望将AI能耗直降10倍。它基于热力学原理,避免删除数据以减少热量产生。经几十年探索,如今可逆计算或成延续计算进步关键。

AGI Hunt
产品应用8

打破56年数学铁律!谷歌AlphaEvolve自我进化实现算法效率狂飙,堪比AlphaGo“神之一手”

谷歌DeepMind联合顶尖科学家打造「通用科学人工智能」AlphaEvolve,打破矩阵乘法领域56年效率基准,将4x4矩阵乘法标量乘法次数从49次降至48次,还在谷歌内部加速了运算、缩短训练时间。文中介绍其原理与技术。

量子位
开源动态7

OpenClaw引爆的AI Agent浪潮中,终于有芯片给端侧“解渴”了

OpenClaw让AI Agent成产业竞赛焦点,但云端方案算力、成本和安全问题凸显。瑞芯微推出端云协同方案ClawChips,采用算力解耦架构,在成本与场景适配间找平衡,还开源并提供开发套件借用权益。

芯师爷
算法论文8

图谱检索全面 or 效率?蚂蚁&浙大Deep GraphRAG:全都要

传统 RAG 遇复杂 Query 易失效,GraphRAG 带来新三难。蚂蚁与浙大提出 Deep GraphRAG,有层次化检索、Beam - Search 重排、DW - GRPO 强化学习三板斧,实验显示其性能优、延迟低。

PaperAgent
算法论文8

注意力机制大变革?Bengio团队找到了一种超越Transformer的硬件对齐方案

Transformer虽改变世界但不完美,线性递归等新方法理论有优势,实际在GPU表现不佳。Bengio团队提出硬件对齐算法框架,用滑动窗口循环和B2P算法,实验显示有速度与质量双重突破。

机器之心