「成本性能平衡」共找到 3309 篇相关文章
CES 2026超前瞻:空间智能来势汹汹!从实验室奢侈品到消费级刚需,如何重塑 AI 具身时代?
2026年CES展上,空间智能从学术概念迈向产业实践。当前具身智能存在‘语言强、手脚笨’困境,空间智能是破解关键。全球分世界生成与空间决策两条技术路径,且行业正迎来成本降低的拐点。
「美队」老黄深夜扔出地表最强GPU!算力百倍狂飙,下次改演雷神
凌晨,老黄GTC主题演讲华盛顿首秀,亮出下一代GPU核弹Vera Rubin,性能狂飙100倍。目前,Blackwell已全面量产,2026年底两大GPU王牌预计爆赚5000亿美金。此外,英伟达还公布了一系列合作与技术创新。
半在线RL新范式UI-S1,使得GUI Agent既稳定又规划长远
现有AI训练方法在GUI自动化中各有弊端,本文提出半在线强化学习范式,训练出UI - S1 - 7B模型,性能提升显著,还提出新评估指标SOP,是迈向实用化AI智能体的重要一步。
Pingpong Schedule并不是万能钥匙
SGLang社区开发者反馈,SM90 FP8 Blockwise Scaling Grouped GEMM从H20迁移至H800后性能下降。文章分析是Pingpong调度策略所致,因算力提升,其使TensorCore未充分利用、TMA效率低,建议用Cooperative策略。
用嘴聊出来了一个 APP:实测「码上飞」语音开发有多离谱
本文实测「码上飞」AI 开发平台,它让用户用对话或语音描述需求,AI 就能做出应用。测试了美甲预约、AI 生图、私域自媒体知识付费小程序三个场景,它表现出色,大幅压缩开发成本,助普通人跨过技术门槛。
让LLM不再话痨,快手HiPO框架来了
当前LLM存在‘过度思考’困境,效率与成本矛盾突出。快手与南大合作推出HiPO框架,通过混合数据冷启动和混合强化学习奖励系统,让模型能自主决策思考模式,实验显示它提升了效率和准确率,还具强泛化性。
NVIDIA技术沙龙 《大规模EP优化:PD分离MoE并行方式》课程笔记
本文是NVIDIA技术沙龙课程笔记,介绍大规模EP优化的PD分离MoE并行方式。涵盖PD分离、大规模专家并行等五项关键技术创新,还对比多模型架构,展示推理服务架构性能特点与优化策略,以及各技术工作流程和效果。
蚂蚁投了一家具身智能公司,做手的
具身智能市场火热,灵心巧手完成数亿元天使轮融资,由蚂蚁集团领投。该公司成立于2019年,此前已有超亿元种子轮融资。其自研灵巧手技术强、成本低、销量高,应用广泛,未来将聚焦软硬件协同。
ICML26 | 浙江理工大学马啸讲师和南京大学李武军教授课题组联合提出EMCES:为强化学习合成更有价值的样本
强化学习获取高质量样本成本高、风险大,现有基于扩散模型的样本增强方法有局限。浙江理工大学马啸讲师和南京大学李武军教授课题组提出 EMCES,将情景记忆机制引入可控扩散模型,提升下游强化学习算法表现,论文已被 ICML2026 录用。
硅谷精英放弃生娃!MIT女记者揭秘:人类只是AI垫脚石,世界很快就毁灭
华人女记者Karen Hao出版《AI帝国》,揭露OpenAI背后隐秘真相。书中提到部分AI行业技术高管因认为世界不久将不复存在而选择不育,还讲述了AI带来的诸多问题,如资源消耗、道德困境等,也指出AI公司拒绝承担现实成本。