「算法研究」共找到 2365 篇相关文章
Megatron 1F1B流水线并行中的负载不均衡问题研究
文章分析Megatron 1F1B流水线并行中负载不均衡问题。通过实验发现通信时间‘一短一长’,原因是最后一个Stage计算慢致不同步,额外计算引发通信延迟,还梳理了流水线各阶段执行过程。
夸克高考,背后藏着的其实是垂类场景「深度研究」方法论
夸克早在2019年就提供高考志愿填报服务,今年推出“志愿报告”功能。其“志愿报告”Agent已生成超1000万份报告,采用PDCA模式给出指导。夸克构建可信度体现在数据库和自研模型上,还降低了幻觉率。
【万字长文】大模型训练推理和性能优化算法总结和实践
本文总结大模型落地的训练、推理和性能优化算法与实践,介绍语言模型发展,对比BERT、GPT等训练方式,分析生成式大模型问题,还阐述数据处理、推理优化及训练调优等内容,并给出不同场景技术选型建议。
人在美国,待过三家AI Lab,全凉了!
科技行业大裁员,Meta裁掉老将田渊栋,AI从业者人心惶惶。南洋理工大学副教授Boyang Li工作过的三家工业研究实验室全倒闭,他分享经历,探讨工业研究困难的原因。
告别盲选LLM!ICML 2025新研究解释大模型选择的「玄学」
弗吉尼亚理工大学研究团队提出 LensLLM 框架,基于 PAC - 贝叶斯泛化界限揭示 LLM 微调性能“双相演进”,可精准预测微调性能、大幅降低计算成本,为 LLM 选型提供新工具。
西门子RXD大会揭秘:AI闯进工厂,胜负手不在算法|甲子光年
西门子于2026年3月23 - 24日召开RXD大会,探讨AI进入生产流程后的挑战与路径。大会指出工业AI落地需软硬协同,西门子依托制造积淀打通全栈技术,还强调开放协作及生态建设的重要性。
多模态推理最高加速3.2倍!华为诺亚新算法入选NeurIPS 2025
华为诺亚方舟实验室研究入选NeurIPS 2025,其提出视觉感知投机推理(ViSpec)框架,解决草稿模型处理图像信息效率难题,在不牺牲生成质量下,对主流VLM最高达3.22倍推理加速。
1899个MCP服务安全研究:7.2%存在漏洞,5.5%暗藏「工具投毒」
研究人员对1899个开源MCP服务器扫描,发现7.2%项目有漏洞、5.5%遭工具投毒。MCP虽成事实标准且发展好,但代码质量堪忧,传统安全工具难检测其风险,为生态敲响警钟。
谷歌AlphaFold得了诺奖,但DeepMind根本没引用前人论文?
AlphaFold获诺奖引发争议。2016年Vladimir Golkov博士在NeurIPS提出的研究或为其「原型」,导师Daniel Cremers质问DeepMind为何不引用。此外,AI界大佬指出早有相关研究,AlphaFold并非孤立贡献。
黄仁勋预言成真!AI智能体成GitHub主力,一天顶人类一年
加拿大女王大学研究揭示AI编程智能体大规模渗透开源社区,它们活跃于开源一线,效率高但代码接受率低于人类,研究为其时代勾勒发展方向,软件工程行业面临变革。