「算力效率」共找到 1912 篇相关文章
永别了,Sora!奥特曼All in超级App
OpenAI一早关停爆火仅6个月的AI视频APP Sora,包括其开发者版本及ChatGPT内视频功能。奥特曼此举是为打造「超级应用」、为IPO铺路,同时为新模型Spud腾出算力,其预训练已完成,将在未来几周发布。
卡帕西点赞Transformer内置计算机!每秒3万Token吞吐,拿下世界最难数独
当前大模型推理顶尖但精确计算不足,Percepta团队在Transformer权重里内嵌可执行程序,通过2维注意力头设计提升推理效率,能在普通CPU上实现每秒3万+Token的流式输出,还精确求解了世界最难数独。
人大高瓴孙浩团队发表Nature子刊封面文章:基于并行符号枚举的物理定律发现
中国人民大学高瓴人工智能学院孙浩教授团队在《自然 - 计算科学》发表封面论文。提出PSE框架解决符号回归瓶颈,通过公共子树复用和GPU并行提升评估效率,实验表现优于现有方法,也指出了局限性与未来方向。
The Batch: 919 | 本地 AI 能否替代云端?
大语言模型预测输出需求推动数据中心扩建,研究人员探讨本地小型模型能否分担算力负荷。斯坦福与Together AI团队研究发现,本地系统单瓦特智能量与云端有差距但在缩小,若准确率相近可节省能耗。
“天才少年”5年0收入造JS核武!Claude天价收购Bun,Node.js生态地震,AI工具链战争正式打响!
当地时间12月2日,Anthropic宣布收购热门开发者工具初创公司Bun。Bun能解决智能体分发和运行的效率问题,受AI编程工具青睐。虽收入为0,但因AI编程发展,Bun团队认为加入Anthropic是更好选择。
无VAE扩散模型! 清华&可灵团队「撞车」谢赛宁团队「RAE」
清华大学智能视觉团队和快手可灵团队联合推出《Latent Diffusion Model without Variational Autoencoder》,提出 SVG 框架,用预训练视觉特征编码器替代传统 VAE,解决了传统「VAE + Diffusion」范式的效率与通用性痛点。
《AI大模型与异构算力融合技术白皮书》正式发布
10月10日,中科算网等联合发布《AI大模型与异构算力融合技术白皮书》,聚焦大模型开发痛点,为开发者提供技术参考。白皮书介绍全球大模型发展概况、应用场景拓展、算力需求与挑战,指出异构算力成主流趋势。
0day漏洞量产?AI Agent“生产线”曝光
本文探讨AI Agent如何通过多智能体协作系统打造0day漏洞“生产线”,实现自动化漏洞检测。经测试和实战验证,Agent在复杂代码和大型项目中表现超传统工具,提升了漏洞识别效率与准确性。
挑战ReAct!MetaGPT团队提出ReCode智能体新范式
DeepWisdom研究员指出当前主流智能体框架受固定决策粒度束缚,提出ReCode新范式。它统一规划与执行,能在不同粒度间自由切换,实验显示其性能、成本和训练效率均有提升,引发广泛关注。
被轻视的巨大市场,大厂做不好的Local Agent为何难?| 甲子光年
文章指出大模型边际收益递减,AI竞赛规则生变,产业从‘参数竞赛’转向‘效率革命’。本地Agent有潜力,但主流产品体验差。GreenBitAI深耕低比特模型,推出Libra,有望撬开万亿美元增量市场。