「算力资源」共找到 1127 篇相关文章
推荐大模型来了?OneRec论文解读:端到端训练如何同时吃掉效果与成本
随着AI发展,推荐系统面临诸多问题,快手技术团队提出OneRec,以端到端生成式架构重构推荐系统全链路,在效果与成本上实现突破,已在快手双端服务用户,也有需完善之处。
黄仁勋亲述:当年如何把“价值数十亿美金”的首台AI超算,亲手送给了OpenAI
英伟达CEO黄仁勋在法国巴黎演讲,讲述OpenAI获得首台AI超算的往事。2016年英伟达推出DGX - 1遇冷,OpenAI表现热情,黄仁勋亲自送机。这体现英伟达对开发者生态的重视和对未来趋势的信念。
Learning from peers!让LRM互相「传纸条」的新协作方式大幅提高准确率和效率
当前主流大模型如QwQ - 32B存在“前缀主导陷阱”,推理开头出错会使准确率暴跌。研究者受“同伴互助”启发提出LeaP框架,设计三种路由策略,实验显示小模型能借此超越大模型,开创了多种可能性。
刚刚,OpenAI任命新CEO!
OpenAI宣布39岁的Fidji Simo出任「应用CEO」,向奥特曼汇报。奥特曼仍为CEO,未来专注研究、算力与安全。Fidji经验丰富,曾在Facebook工作十年,还担任过Instacart CEO。
突发,Fable 5.1泄露了!Claude又叒叕全球大宕机
今日,Fable 5.1被曝开启灰度测试,部分Claude用户已免费试用。推测其可能很快全量推送且不涨价。此前Fable 5因性能强受限,开发者期待5.1版。同日Claude全球大宕机,Anthropic正冲刺万亿估值。
揭示扩散语言模型扩展定律,人大高瓴团队与蚂蚁集团发布LLaDA MoE v2
中国人民大学高瓴人工智能学院与蚂蚁集团合作,首次系统刻画混合专家扩散语言模型扩展定律,据此训练LLaDA MoE v2,实现扩展效率与智能双重突破,将推动其迈向规模化时代。
英伟达和AMD,开始争夺AI制药的计算入口
每年的 Advancing AI 大会,AMD 都要回答 Instinct GPU 除训练大模型外的应用问题。今年大会上,AMD 把一个位置留给 AI 制药公司 MindWalk。而其对手英伟达已在生命科学领域布局多年,生命科学成两家竞争新战场。
AI产业正在围着OpenAI和Anthropic两家公司打转
过去半月AI行业看似平静,实则产业结构正密集重组。OpenAI、Anthropic成算力黑洞,众多公司围绕其开展业务。同时,AI落地服务成新赛道,自研芯片潮兴起,产业分工不稳定。
Cursor 终于让你可以关笔记本了
昨夜,AI编程工具Cursor发布Agent云功能更新,解决本地运行占资源问题。可本地云端无缝切换,10分钟搭云端开发环境,有独立云子Agent隔离任务,iOS测试版上线,获用户认可。
DeepSeek V4永久降价!缓存命中再打1折,实测编程成本骤降83%
DeepSeek两天连续两次降价,输入输出2.5折,命中缓存输入折上再1折且无时限。实测编程成本骤降83%,此前31.73元,打折后只需5.34元。其曾引发价格战,此次对海外用户冲击更大。