「计算效率」共找到 1774 篇相关文章
Qwen3-Next:迈向更极致的训练推理性价比
文章发布Qwen3-Next架构及Qwen3-Next-80B-A3B系列模型,通过混合注意力等改进提升训练推理效率。介绍模型结构、性能优势,还说明使用方法,包括在多平台部署及处理超长上下文,展望持续优化架构。
醒醒吧!CEO猛吹AI写95%代码,绩效考核却还在拼程序员手速?
本文是对 Superhuman 工程负责人 Loic Houssier 的深度访谈。他分享了 AI 时代团队管理、开发流程、绩效评估等方面的变化,指出 AI 虽提升效率,但在质量评估、人才适配等方面仍需探索,还强调观望 AI 发展会有职业风险。
快手电商磁力金牛正在验证一件事:AI能不能真正帮商家赚钱?|甲子光年
电商广告投放正发生底层迁移,越来越专业化。快手电商磁力金牛用AI接管投放决策,其AI一键推广和全链路AI操作系统降低了中小商家门槛,提升投放效率,预示电商广告平台竞争将转向‘谁的AI更懂生意’。
斯坦福洗碗机器人新作!灵巧手跟人学采茶做早餐,CoRL 2025提名最佳论文
斯坦福等机构提出DexUMI框架,利用人手将操作技能迁移至灵巧手。该框架通过软硬件创新缩小人手与灵巧手具身差异,在两款灵巧手硬件平台验证,平均任务成功率达86%,数据采集效率提升3.2倍,被CoRL 2025提名最佳论文。
纯CPU“踢开”GPU,中国超算九年后再登顶!
6月23日,国家超级计算深圳中心“灵晟”超算以2.19EFlops性能登顶全球超算TOP500榜单,这是世界首台超2EFlops的超算系统。它基于“灵鲲”平台,采用纯CPU设计,展现我国超算全栈自主可控能力。
GPU到底是如何工作的?这篇AI Infra入门全部告诉你
本文详细介绍了GPU工作原理及编程模式。它从图形渲染发展到GPGPU,NVIDIA推动其通用计算。还阐述了CPU/GPU异构架构,对比二者性能,介绍编译、加载、启动过程,以及GPU硬件架构、编程与执行模型,分析SIMD和SIMT。
成熟工程师1天完成调试,AI工程实践被MCP彻底颠覆?
去年11月Anthropic发布模型上下文协议(MCP),开发者社区迅速采用,AWS、GitHub、OpenAI等也已采用。MCP标准化数据和工具与AI代理的集成,简化定制化AI应用构建。采访华院计算杨小东,解析其架构、应用及商业价值。
老外傻眼!明用英文提问,DeepSeek依然坚持中文思考
DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用中文思考。评论有两种观点,相关论文显示中文省token但非最有效,大模型选思考语言并非只看效率。
DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO
文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。
WRC 2026 深度复盘:具身智能的「卡脖子」难题,终于有解了
本文复盘WRC 2026,指出具身智能面临数据焦虑,数采方与模型方割裂,数据采集成本高、效率低、质量差。自变量推出QUANXTA Zero系列无本体数采方案,从模型需求反向定义数采硬件,形成数据闭环,还具备底层技术支撑。