「算力成本」共找到 2157 篇相关文章
小白也能秒懂:趣解GPU各种核心参数规格!
近期美国升级对英伟达H20芯片出口管制,业内震动。文章介绍GPU和显卡区别,讲解GPU关键参数如算力、核心数量等含义,还通过货车、火车类比助小白理解,助读者选合适GPU。
给大模型装上「思维分段引擎」:浙大InftyThink解锁无限深度推理
如今大模型长上下文推理面临计算成本高、推理易中断问题。浙大联合北大团队提出InftyThink新范式,将传统推理拆成短片段并总结,突破推理长度限制,在多基座模型实验中表现优异。
八年孤独,Iceberg 赢得世界
本文讲述 Iceberg 的发展历程、技术特性、用户案例及商业生态。它从解决 Hive 痛点孵化,经开发者、客户、厂商推动成开放表格式标准。其 V3 Spec 补充短板,社区开始构想 V4 。诸多科技大厂深度使用并贡献代码。
港科联合港中文提出AdaCtrl,自适应可控Reasoning,可降10~90%
港科联合港中文提出AdaCtrl,解决LLM推理的过度思考、算力浪费和响应延迟问题。它有自适应和用户控制两种模式,通过两阶段训练法实现目标,实验效果好,未来或拓展到多领域。
北大DeepSeek论文或预定ACL Best Paper!梁文锋署名
北大DeepSeek联合发布的NSA论文已被ACL 2025录用且评分高,有望冲击最佳论文。该技术革新传统注意力机制,提升算力效率,是长文本处理的突破。此外,张铭教授团队还有多篇论文上榜。
ICML 2025|如何凭「自动补全」实现100K生成3×加速?
在大模型推理复杂的当下,生成超长文本成本高。BIGAI NLCo团队提出推理加速框架TokenSwift,被ICML 2025接收。它重构传统自回归推理,解决长生成瓶颈,在多模型实验中表现亮眼。
Fable 5.1 官方提示词指南
Anthropic 发布 Fable 5.1 后,同步发布《Prompting Claude Fable 5.1》提示词指南,列出 15 个 5.1 跟 Fable 5 在行为上的差异,并附修正提示词。还介绍了 Fable 5 提示词变化,以及 Fable 5.1 的新特性和应对建议。
Ilya交卷!黄仁勋砸50亿押注SSI,首个模型疑本周发布
Ilya Sutskever创立的SSI或本周发布首个重磅模型,引发圈内关注。英伟达砸50亿美元合作,提升其算力。该模型基于测试时训练架构,能边学边进化,或终结大模型“预训练时代”。
老黄斥资60亿美元,打造全球顶尖开源模型!
多家外媒爆料,英伟达计划斥资60亿美元打造全球最强开源权重AI模型。为此,英伟达买下Poolside的技术,挖走其核心团队,追加巨额投资。这让AI大模型竞争格局或变天,英伟达也将与大客户成对手。
挑战 1 比特!ETH Zürich 秦浩桐:如何把大模型「塞进」小设备?| IJCAI 2026
IJCAI 2026大会上,秦浩桐给出创新解法,挑战无需重训的“后训练量化”极限,将庞大的LLM强行压缩至极端的1比特与2比特。其团队的BiLLM与SqueezeLLM打破了后训练量化魔咒,还指出极低比特量化的三大挑战。