「自主智能测试」共找到 5084 篇相关文章
M2模型杀回Coding和Agent领域,MiniMax想要「普惠智能」
如今大模型竞争转向综合比拼,MiniMax 发布并开源 M2 模型,在权威测评跻身全球第一梯队。它定位轻量级,Coding 与 Agentic 能力强,性价比高,还升级 Agent 产品,以技术普惠策略让用户零成本体验。
上海AI Lab提出CANON:让RLVR自主识别优质推理模式
上海AI Lab与上海交大团队提出创新框架CANON,解决将人类先验知识融入RLVR训练的难题。它通过条件分组与对比机制,自适应放大有益指标变化趋势,在数学和逻辑推理任务上成果卓越,还能提升推理效率。
首个开源多模态Deep Research智能体,超越多个闭源方案
首个开源多模态Deep Research Agent登场,整合多种工具并优化决策。其WebWatcher技术方案覆盖全链路,实验中在四大核心领域领先主流模型,展现复杂推理和信息检索实力。
GAIR Live 预告|世界模型——通向通用智能的关键拼图
随着AGI议题升温,‘世界模型’成前沿焦点。GAIR Live将邀顶尖学者与专家,探讨其定义、趋势等问题,还有直播议题如Lecun观点看法、不同领域世界模型差异等。
ChatGPT智能体正式发布,多个创业赛道昨夜无眠
OpenAI正式发布ChatGPT Agent,将思考与执行能力统一,可接管电脑,能处理工作和生活多种事务。它优化后能力达SOTA,但也有风险。这或重塑互联网,让Agent创业者重新审视竞争力。
一站式智能分析引擎,快速构建企业级数据分析 Agent
在数据驱动的商业环境中,传统数据分析流程有诸多局限。本文介绍基于阿里云实时数仓 Hologres 和阿里云百炼的联合方案,结合 Function AI 平台,可构建企业级数据分析 Agent,实现端到端加速。
对话刘靖康:镜头之外的「智能」和「审美」,才是 Camera Agent 的主战场
影石 Insta360 创始人刘靖康在 AGI Playground 2026 上提出未来影像设备“前轻后重”趋势。他介绍了 Cameraman 愿景,涵盖 Imaging、AI、Robotics 三技术方向,还提到云端 AI 剪辑服务情况及对行业多方面的见解。
具身智能“高考”难疯了!人类100分,最强模型12.8
原推出RoboTwin系列基准的团队带来RoboDojo,这是统一的仿真+真实世界机器人操作评测基准。它设42个仿真任务、18个真实任务,让30个主流策略竞技,结果显示机器人距通用操作差距大。
具身智能空间视觉死穴,终于被最新顶会彻底解决!
招商局先进技术研究院下属实验室提出新的移动数据范式,以极低成本破解 VLA 的空间泛化瓶颈。研究团队识别出 VLA 模型三种捷径学习模式,提出层次化数据解耦策略,该方案在主流 VLA 模型上验证有效。
人大和微软开源Arbor,一棵假设树突破自主科研新高度
中国人民大学和微软研究者推出Arbor,它将实验挂到假设树,让研究信息跨周期保留。在六道真实研究任务中表现优异,增益超Codex和Claude Code,且成本相当,还能从失败中积累经验。