测试时扩展」共找到 2663 篇相关文章

开源动态8

具身智能的Skill刻!英伟达开源机器人技能库,Jim Fan:范式变了

英伟达开源能让机器人持续成长的技能库ASPIRE,类似机器人版Coding Agent,会沉淀机器人操作经验。英伟达机器人主管Jim Fan称其代表全新持续学习范式,论文实验验证其效果好于此前方法。

量子位
新闻资讯8

人类已成少数派!DeepMind 研究科学家:广告没人看了,互联网上AI的流量已经超过了真人

Google DeepMind高级研究科学家Nenad Tomašev预测,未来世界主要网民将是智能体。他指出智能体虽能自动化工作,但存在安全风险,如认知单一化、网络陷阱等,还探讨了协作模式、安全防护及未来形态。

AI科技大本营
算法论文8

多模态大模型别盲目刷题!诊断-生成-强化闭环,找准盲点 | ICML'26

多模态大模型训练常采用‘题海战术’,存在能力诊断不精准、视觉内容缺乏扩展等问题。北大和山大团队提出DPE框架,通过‘诊断-生成-强化’闭环提升模型能力,实验效果显著,还强调训练应具备诊断能力。

新智元
新闻资讯8

中国九章4.0量子计算机再破世界纪录,比超算快10的54次方倍

中国科学技术大学潘建伟院士团队在Nature发表论文,展示九章4.0量子计算机,它用光子计算,在解决高斯玻色取样问题比超算快10的54次方倍,还攻克两大核心技术,有重要应用潜力。

DeepTech深科技
推荐文章8

让AI Agent自动接Issue、写代码、上线:我用200行代码搭了一个全自动开发流水线

文章介绍AI Agent驱动的全自动开发流水线,对比传统流程,指出开发者角色转变。列举开源工具,给出200行代码的最小实现,分析半自动与全自动差异及信任鸿沟,点明开发自动化趋势,还给出落地建议。

AI Reading Hub
算法论文8

ICLR最佳论文:Transformer天生简洁

2026年ICLR最佳论文对Transformer做深度思维体检,指出其架构真正威力在于描述概念比RNN等简洁指数级甚至双重指数级,但验证其内部逻辑计算成本高昂,为解释其能力开新窗。

AIGC开放社区
推荐文章8

Qoder Skills 完全指南:从零开始,让 AI 按你的标准执行

文章介绍Qoder Skills,它是强大AI定制方式,像菜谱让AI按标准执行。阐述本质、结构、原理,对比与其他工具差异,说明适用场景、安装方法,还有实战演示、编写规范、测试迭代及团队协作等内容。

阿里云开发者
新闻资讯8

Claude Opus 4.7发布!这是你在别的公众号看不到的五个发现

Anthropic发布Claude Opus 4.7,编码和视觉能力提升,但长上下文能力下降。其231页的System Card藏着不少有趣发现,如Opus 4.7非最强模型、Claude知道被测试、模型审查自身评估等。

花叔
算法论文8

论文发表 || 如何基于累积过程变换学习弱非线性振动方程(EvLOWN)

2026年3月6日,赵林等教授团队在《Advanced Science》发表论文。提出EvLOWN数据驱动理论,利用平均法重构推断方程目标,扩展微小效应可推断性边界,在多领域应用效果好,但有未考虑SDE等局限。

力学与人工智能
算法论文8

一句话生成无限逼真3D场景!匹兹堡大学新作直击VLM空间推理软肋丨CVPR'26

VLM在3D空间推理上表现不佳,且缺乏合适测试基准。匹兹堡大学团队提出InfiniBench框架,用LLM Agent迭代优化和聚类策略,可按需生成3D场景,还能精准定位大模型空间推理缺陷。

量子位