「推理加速技术」共找到 4901 篇相关文章
马斯克刚关注了这份AI报告
受谷歌DeepMind委托,Epoch发布报告剖析2030年AI的发展。指出训练成本或超千亿美元,公开文本数据2027年耗尽等,马斯克也关注此报告。还从多方面论证发展趋势可延续,且AI将加速多领域科研。
Lumina-mGPT 2.0:自回归模型华丽复兴,媲美顶尖扩散模型
上海人工智能实验室等团队提出Lumina - mGPT 2.0自回归模型,统一多种图像任务。它采用独立训练架构、统一多任务处理框架和高效推理策略,实验表现优异,后续将优化采样时间并扩展至多模态理解。
突发!卡帕西宣布入职Anthropic
大神Karpathy宣布加入Anthropic,重回一线大厂。他曾多次在AI领域转换角色,此次将加入预训练团队,开展用Claude加速自身预训练研究。外界揣测其离开OpenAI原因,加入Anthropic能为研究提供更多资源。
每周免费送1亿Token!扎克伯格押注王牌产品Muse:AI会24小时替你赚钱,我只负责抽成
本文整理科技记者对扎克伯格的播客访谈,扎克伯格公开反对AI技术被少数机构垄断,介绍了Meta全新推出的个人AI产品Muse的产品设计、商业模式与研发思路。
英伟达400亿押注开源,边卖铲子边挖矿
英伟达被曝砸60亿美元押注开源模型,向Poolside投资10亿美元并买其‘模型工厂’技术非独家使用权。它主张闭源开源两手抓,此前已发布系列开源模型、组建联盟,开源布局广泛。
1吨旧手机能提取约200克黄金?你家的闲置手机可以这样处理→
我国年均产生废旧手机超4亿部,回收率低,因回收价低、信息安全顾虑,大量闲置。但旧手机资源回收价值高,“以旧换新”政策和技术升级正推动回收产业发展,打消消费者顾虑。
深夜炸场!Claude Sonnet 4.5上线,自主编程30小时,网友实测:一次调用重构代码库,新增3000行代码却运行失败
Anthropic推出Claude Sonnet 4.5,号称‘世界上最好的编码模型’,持续运行时长、推理等能力提升,‘幻觉’等问题改进,Claude Code也有更新,开发者实测有惊喜也有问题,新一轮AI‘内卷’开启。
编程通缩——当代码一天比一天便宜会发生什么
文章探讨编程通缩现象,即AI使软件开发成本等下降。它不同于传统通缩,由生产力提升驱动,会带来延迟与实验、质量两极分化等悖论,还会加速创新,人们应培养相应技能适应。
创始人不懂增长,团队再忙活也没用
文章指出很多创始人虽技术、团队出色,但对产品增长数据避而不谈。他们高薪招增长负责人却全权交托,自身缺乏增长认知,这在当下很危险。还提到 9 月 20 - 21 日将分享增长调研成果。
天下武功,唯快不破:LLM高效架构最新最全面综述
大型语言模型虽成就辉煌,但训练成本高、推理延迟大,核心问题源于Transformer架构。这篇综述论文首次系统性梳理高效LLM架构创新方案,分类七大类方法,延伸至跨模态应用,为研究者提供‘效率蓝图’。