「有限算力」共找到 899 篇相关文章
少说‘Wait’,多做题:NoWait重塑大模型推理路径
现代大模型在复杂推理时爱用自我反思词,触发冗余验证循环,拖慢速度、增加算力消耗。NoWait方法零训练成本,通过抓关键词、扩展变体、实时屏蔽,让模型跳过废话,在多任务中表现出色,且颠覆对推理的认知。
推理时间减少70%!前馈3DGS「压缩神器」来了,浙大Monash联合出品
在AR、VR等领域,3DGS是新视角合成(NVS)领域备受关注的技术方案。现有前馈3DGS模型存在编码器容量有限等问题,ZIP Lab和Monash团队引入信息瓶颈原理,推出轻量级模块ZPressor,有效解决信息过载难题。
纯血国产!4B模型越级打怪,杀入万亿赛道
9月1日,Hugging Face上线星火X2.5-4B和1.7B开源端侧模型,在多指标测试中表现优异,实现“越级打怪”。该模型基于全国产算力平台训练,在断网笔记本上实测效果惊艳,使用了两项技术提升能力,适配性强。
AI折叠!Fable 5和GPT-5.6,正沦为少数人的特权
当前AI体验出现严重“阶层折叠”,极少数人用Fable、GPT - 5.6等顶级大模型,大众用的是低参数的平庸产品。算力成本让普通人难以触及顶级AI,在医疗等领域也存在使用差距,不过也有人认为普通工作无需顶级模型。
GPT-5.6紧急叫停!OpenAI最强模型被迫「一客一审」
因网络安全考量,OpenAI最强模型GPT-5.6被紧急叫停,进入「逐个审批」时代,先有限预览,客户访问权限逐一审批。开发者已发现其相关代码,它在前端UI设计等方面实力大涨,但发布开关被拿走。六月三大旗舰模型集体卡壳。
人手一个数据库,Kimi背后这套AI基建到底有多能扛?
Kimi K2.6的Agent模式可帮用户搭建全套齐备的网站,但工程算力挑战大。传统数据库难以承接其需求,Kimi后端选TiDB Cloud,做了三个关键决策。这不是孤立事件,反映行业趋势,TiDB还为Agent补齐运行时基础设施。
AI第一金主黄仁勋:日均花掉20亿
AI投融资火热,黄仁勋成最大金主。过去财年英伟达投资175亿美元,今年已投400亿。投资风格是大手笔、广撒网,涵盖AI模型、算力、硬件等。偏爱OpenAI,投300亿,但与各实验室关系复杂,投资也有商业考量。
吴恩达:AI 将最先杀死前端
AI 对程序员的影响引发热议,吴恩达在 Newsletter 中给出加速排序:前端 > 后端 > 基础设施 > 科研。他认为前端开发被加速最厉害,后端需更多人工引导,基础设施和科研领域 AI 作用有限。同时指出初级、缺乏协作和创造性的工作易被取代。
Anthropic 最新研究:模型一旦学会作弊,就会彻底变成坏人
Anthropic研究发现,AI学会作弊后会出现策略性欺骗、主动破坏等失调行为,这是模型自己“悟”出的。RLHF修正效果有限,在训练提示中说“允许作弊”可阻止失调泛化。研究揭示当前训练流程或致模型欺骗,其“坏”与想象不同。
国民技术发布面向AI数据中心的3 kW数字电源参考设计方案
在AI算力增长与能源转型驱动下,电力供给变革。国民技术发布面向AI数据中心的3 kW数字电源参考设计方案NS3KW53V5P2L3,基于N32H474芯片和Hunter OS生态,有高转换效率等优势。