「硬件成本」共找到 1925 篇相关文章
0成本升级,快手OneSearch-V2全量上线,生成式搜索进入「懂你」时代
快手技术团队在 OneSearch 基础上推出 OneSearch-V2 框架,解决电商搜索复杂查询理解不足等问题。该系统全量上线,不增成本与时延,业务收益显著,还缓解信息茧房与长尾稀疏问题。
裸辞北大博士带17个Agent,49天造出全球首个AI开放世界!成本仅5000
北大文科博士刘耕带17个Agent,49天、5000元成本、30万行代码造出全球首个AI开放世界Elseland。其玩法、世界、创造都具开放性,刘耕逆风突围,开发效率大幅提升。
训练成本暴降99%,35秒出1分钟高清视频!英伟达MIT等引爆视频AI革命
英伟达联合MIT、港大团队提出SANA - Video架构,其核心是创新的全局线性注意力Diffusion Transformer训练框架和全局显存恒定的KV缓存机制。它训练成本低、速度快、可部署,重新定义AI视频生成效率极限。
Agent 跑分追平 Codex、成本低至 1.95 美元,这家中国公司做到了
德勤报告显示86%多Agent项目落地失败,硅谷也出现‘无限智能体死循环’。EvoMap团队的EvoX采用‘蜂群式自进化’打法,系统容错率翻倍、完成率跃升,成本大幅降低。跑分追平Codex,还展现出自组织潜力。
奥特曼回应OpenAI硬件抄袭:投资没谈拢就来反咬我!新一轮邮件证据曝光
奥特曼就OpenAI硬件“抄袭门”回应,称IYO投资不成就诉讼,还公布邮件证据。双方各执一词,争议不断。此外,OpenAI正为ChatGPT设计协作和聊天功能,与办公工具竞争。
20人团队提前实现DeepSeek构想,AI算力变天?直击大模型算力成本痛点
国内20人玉盘AI团队推出SRDA全新计算架构方案,试图从硬件源头解决当前AI算力核心瓶颈。该架构有诸多创新设计,能应对大模型训推痛点,与DeepSeek构想契合,或成大模型专用架构分水岭。
为MoE解绑:全新「专家即服务」推理架构发布,超细粒度扩展锐减37.5%成本
近年来大模型推理开销增长,MoE架构虽能避免计算量同比增,但带来扩展性差、容错性低、负载不均等问题。为此作者提出全新「专家即服务」推理架构EaaS,实验显示它能锐减37.5%成本。
推荐大模型来了?OneRec论文解读:端到端训练如何同时吃掉效果与成本
随着AI发展,推荐系统面临诸多问题,快手技术团队提出OneRec,以端到端生成式架构重构推荐系统全链路,在效果与成本上实现突破,已在快手双端服务用户,也有需完善之处。
GPT-5.6 Sol首批内测结果来了!同任务成本只有Fable 5一半
GPT-5.6 Sol预览版发布半月,首批内测报告出炉。它代码简洁,适合长链路任务,视觉效果好。虽整体略逊Fable 5,但成本近乎减半,且安全限制小,即将全量上线。
大模型能力,小模型成本!Google等 | 提出递归混合框架:MoR, 大幅提升LLM计算效率
Google提出递归混合框架(MoR),融合参数共享与自适应计算。它有轻量级路由和KV缓存策略,在不同路由机制各有优劣。实验显示,MoR在性能、计算和内存效率上表现出色,有望实现“大模型能力,小模型成本”。