「测试时扩展」共找到 2641 篇相关文章
AST| 西工大单湘淋、张伟伟等:基于湍流各向异性分析与符号回归的改进型二阶非线性涡粘模型
针对非线性涡粘模型各向异性建模难题,西工大单湘淋、张伟伟等通过雷诺应力各向异性分析方法开展特征提取,构建新型二阶非线性涡粘模型,在方形管道与矩形扩压器湍流测试中,精度优于现有模型。
12个Ai编程Agent同台PK,最贵的不一定是最强的
上海交大和美团联合发布PRDBench论文,将12个主流AI编程Agent放入50个真实Python项目测试。结果显示,基础模型写代码强,商业版调试优势明显;专门训练的裁判模型比通用大模型靠谱。
拒绝Reward Hacking!港科联合快手可灵提出高效强化学习后训练扩散模型新范式
使用强化学习微调扩散模型时,常面临Reward Hacking和KL正则化阻碍探索收敛的问题。港科等团队提出GARDO框架,通过门控自适应正则化和多样性感知优化,解决痛点且全面开源。
谷歌云重磅报告:AI智能体接管2026年企业核心工作流
谷歌云基于调研发布报告,揭示2026年重新定义角色、工作流和商业价值的五大关键趋势,如智能体重塑员工、数字化流水线打通企业、全时在线重塑客户体验等,还强调人才技能重塑的重要性。
大模型“记性差一点”反而更聪明!金鱼损失随机剔除token,让AI不再死记硬背
马里兰大学等团队提出金鱼损失法,训练时随机剔除部分token,让模型不逐字记内容,仍学语言规律。实验显示,LLaMA - 2用该方法后记忆内容减少,下游任务性能影响小。
太强了 Yan!腾讯打造的全能交互视频生成引擎
腾讯提出的面向交互式视频生成的基础性框架 Yan,集 AAA 级模拟、多模态生成和多粒度编辑于一体,为下一代 AI 内容引擎提供可行路径,但也面临长时视频视觉一致性不足等问题。
告别人工干预!KDD Cup 2026 Data Agents 赛道:定义下一代数据智能体能力边界
KDD Cup 2026 发布 Data Agents for Complex Data Analysis 赛道,由香港科技大学(广州)和清华大学联合承办。旨在推动 AI 告别人工干预,具备自主任务分解等能力,还推出 DataAgent - Bench 测试平台,有丰厚奖励,公布关键时间节点。
英伟达早不靠GPU躺赢!黄仁勋终极预判:10亿程序员时代将至,AI智能彻底廉价
2026 年 GTC 大会后黄仁勋接受深度访谈,他指出 AI 核心竞争转向“AI 工厂”,扩展定律沿四条路径推进,未来大量数据是合成数据。他还预测程序员将达十亿级,强调人人学 AI,认为智能会商品化,人性高于技术。
回村拜年、赶集舞狮:一台小机器人的县城奇幻漂流|甲子光年
2026马年春节,人形机器人迎来高光。‘清华系’加速进化公司将小型人形机器人Booster K1带回乡村,在多样场景测试。该公司走小而美路径,产品性能优、销量好,通过B端、C端策略打开市场。
告别「解码器饥饿」!中国科学院NeurIPS推SpaceServe,高并发克星
中国科学院计算技术研究所入选NeurIPS 2025的论文提出SpaceServe架构,将LLM推理P/D分离扩展至多模态场景,通过EPD三阶解耦与「空分复用」,解决MLLM推理行头阻塞难题,在Qwen2 - VL系列模型实测中表现出色。