「GPU折旧周期」共找到 521 篇相关文章
监督学习未死,一题训练五小时起飞!华人学者新方法20倍训练效率释放大模型推理能力
大模型推理能力研究中,RL训练资源成本高、不稳定,传统SFT低数据量易过拟合。加拿大滑铁卢大学华人团队提出One - Shot CFT方法,用一题多解多点评训练,仅需约5个GPU小时,效果好、稳定性强。
英伟达再出手!新型混合架构模型问世,两大创新实现53.6倍吞吐提速
英伟达研究者提出新混合架构语言模型 Jet - Nemotron,在达 SOTA 全注意力模型精度时效率卓越,2B 版性能超 Qwen3 等,H100 GPU 上生成吞吐量最高加速 53.6 倍,基于 PostNAS 和 JetBlock 两大创新。
全球AI新王诞生!Anthropic估值冲爆1.2万亿,首次反超OpenAI
Anthropic估值达1.2万亿美元反超OpenAI,若上市将成全球第11大上市公司。其年化收入和使用量一季度同比增80倍,获马斯克22万张GPU及谷歌2000亿美元云服务协议,但维持高估值面临挑战。
狂揽 1.9 万标星!谷歌大神开源的 Agent Skills,直接提升 AI 编程的交付质量!
谷歌Gemini团队主管Addy Osmani开源的Agent Skills项目火了,已揽1.9w+ Star且还在增长。它是AI编程代理人的工程技能库,有20个核心技能,覆盖开发全周期,可提升AI编程交付质量,支持主流编程工具。
俩“中国英伟达”,给了FA信心
国产替代和AI浪潮下,摩尔线程和沐曦股份同日递交招股书引发热议。招股书显示,二者Pre - IPO轮融资给FA数千万甚至上亿顾问费。这或因GPU研发烧钱、市场竞争激烈,快速融资对企业很重要。
AI首次拿下IMO官方满分金牌,背后藏着一套自我纠错机制
在第67届国际数学奥林匹克(IMO 2026)上,小红书的「dots-note-3.0」成为首个获官方满分金牌的AI模型。它解题时自我检查修正,有自主探索能力。之后模型要应对生活中长周期、多变任务的挑战。
再创历史!英伟达市值一夜突破5万亿美元,今年涨幅56%,黄仁勋晋升全球第八富豪
10月29日,英伟达市值突破5.03万亿美元,成全球首家破5万亿美元公司,今年涨幅56%。黄仁勋以1792亿美元持股价值居福布斯富豪榜第八。这或因GTC大会公布多项革新与合作,且AI热潮让其GPU需求旺盛。
对话范浩强:10亿融资之前,我们手搓了5000元“丐版硬件”
原力灵机是具身智能新秀,9个月连融3轮获阿里数亿投资。其创始团队多出自旷视,从To B工业场景切入物流行业。公司发布开源三件套,还将开源基座模型,强调创业要穿越周期,谨慎慢跑。
入局AI Infra:程序员必须了解的AI系统设计与挑战知识
文章分享传统后台工程师技术栈和方法论如何迁移到AI系统,系统性拆解AI Infra的硬件、软件、训练和推理挑战,如硬件从CPU到GPU、软件依赖深度学习框架,还分析训练和推理面临的问题及解决办法。
嘘,Claude正在「做梦」!睡一觉疯狂进化,一夜暴涨6倍战力
Anthropic在Code with Claude开发者大会上,给Claude托管智能体添加Dreaming功能,让其能自动回顾记忆、自我进化,还发布Outcomes和多智能体编排。法律AI公司Harvey用后任务完成率飙升约6倍。Anthropic还租下22万张GPU算力。