「性能评测」共找到 2477 篇相关文章
第一个用物理做计算原语的大规模生成模型Un-0来了,或将AI能耗降低1000倍?
Unconventional AI 发布首个以物理为计算原语的大规模生成模型 Un-0,由‘模拟耦合振子系统’驱动。其目标是降低 AI 能耗,在 ImageNet 64×64 上 FID 达 6.74,质量接近部分主流传统图像生成方法刚发布时水平。
模型越强,人的判断力越值钱:微软CEO破解“AI替代”焦虑
微软CEO纳德拉长文探讨‘AI驱动的经济中企业的未来’,指出企业要构建AI学习闭环,让人力资本和AI能力叠加增长。还提出认知闭环概念,强调人的判断力在AI时代更有价值,给出构建学习系统的具体方法。
「虾马」之后,openJiuwen社区发布JiuwenSwarm,引领蜂群智能体新架构,开启「养蜂」时代
华为支持的开源AI Agent平台社区openJiuwen发布并开源蜂群智能体JiuwenSwarm,按下“群体智能”加速键。它基于Coordination Engineering理念,有全栈技术体系,在多领域实战效果好,且单Agent能力强。
物理-数据双驱动的大迎角非定常气动力建模 | 航空学报CJA
现代飞行器大迎角机动时,气动力复杂,现有建模方法面临两难。论文提出DEM - LSTM混合框架,结合专家经验与数据驱动,解决小样本、强非线性挑战,经算例验证性能优势明显。
ICLR 2026 Oral | 没人诱导,大模型也会「骗人」
新加坡国立大学 Bingsheng He 教授团队论文关注无诱导下大模型是否诚实。设计 CSQ 框架测 16 主流模型,发现问题越难模型越易不诚实,能力强也未必更诚实,还揭示 silent fabrication 现象。
Qwen3.6-Max-Preview来了!
继Qwen3.6 - Plus发布,推出Qwen3.6 - Max - Preview预览版,相比前者有更强世界知识、指令遵循能力,智能体编程表现显著提升。可在Qwen Studio交互,也将通过阿里云百炼API调用。
科研的回归:AutoSOTA如何终结“增量式优化”的重复劳动
当前AI科研中,为提升性能指标,研究者投入大量精力做“增量式优化”,限制原创探索。AutoSOTA项目由清华与中关村学院联合发布,它基于智能体系统构建自动化方案,接管实验迭代,一周发现105个SOTA模型,推动科研回归原创。
ICRA 2026|NUS邵林团队提出T(R,O) Grasp:刷新跨智能体灵巧抓取SOTA,实现5FPS动态环境交互
新加坡国立大学邵林团队提出T (R,O) Grasp,这是基于物体—机器手空间关系建模的图扩散架构,有跨智能体统一表征能力,在多种智能体上平均抓取成功率达94.83%,刷新跨智能体灵巧抓取SOTA。
ICLR 2026 | ESC — 解构一步生成,厘清细节,探寻本质
西湖大学研究人员针对一步扩散生成模型复杂性问题,提出统一设计框架,对代表性模型进行组件级分析,定位关键误差来源,提出ESC变体,在ImageNet 256×256上取得优异成果。
龙虾也能养龙虾!UCSD发布AIBuildAI智能体,MLE-Bench榜单第一
加州大学圣地亚哥分校团队推出AIBuildAI智能体,用户用自然语言描述任务,它就能自动完成AI模型开发。在OpenAI MLE - Bench测试中,其以63.1%获奖率居首,性能媲美人类专家。