元代理框架」共找到 2490 篇相关文章

8

刚刚,中国AI闯入全球编程前二!前面只剩Claude

Code Arena最新榜单出炉,Qwen3.7 - Max以1541分冲进全球第四,是前五中唯一非Claude模型。它在多项测试中表现出色,是为长时间自主执行任务设计的Agent基座模型,编程跃升或与环境扩展、长程自主执行训练方法升级有关。

新智元
新闻资讯7

Claude不到4%,全军覆没!一场大考撕碎Agent「全自动办公」幻想

新智报道,UniPat AI的SaaS - Bench实战考卷,用23个真系统、106个任务测试Agent。结果显示,Claude Opus 4.7完全通过分数仅3.8%,多数模型全军覆没,暴露了Agent在真实环境中的四种致命缺陷。

新智元
算法论文7

航空学报|西工大袁昊、寇家庆等:基于预解分析的低雷诺数翼型优化设计方法

本文将预解分析引入翼型外形优化,构建流动系统线性化模型,以最大预解增益表征流动稳定性。建立优化框架获Opt.1和Opt.2构型,优化后翼型流动稳定性提升、气动性能改善,方法有外推潜力。

力学与人工智能
新闻资讯7

GitHub 推出 MCP 服务器集成,全面扩展机密扫描功能

GitHub宣布MCP Server全面支持机密扫描功能,将其扩展至AI辅助和代理驱动的开发工作流,可让外部工具和AI工作流访问安全洞察、自动化修复。这反映安全工具正从被动检测转向自动化治理。

InfoQ
算法论文8

CVPR 2026 Oral|告别模型合并冲突!南大等提出OrthoReg:极简正交正则化,揭开任务算术的底层机制

南京大学等团队为任务算术建立底层理论框架,提出「任务特征特化」属性,推导出几何约束方法OrthoReg。该方法引入极简正交正则化项,提升模型合并性能,论文被CVPR 2026接收并评为Oral,代码等已开源。

机器之心
开源动态7

第六章 Coding优先编的是「过程与约束」,不是「参数」

本章以开面包店类比训练大模型,介绍 AutoResearch 自主实验框架。它将研究生助理工作循环交给 Agent,在固定时间用单一指标判断好坏。仓库获约 64.7K Stars,Karpathy 设计哲学为极简主义与固定约束。

CourseAI
新闻资讯7

罗福莉:Claude订阅封杀龙虾背后,真正的出路不是更便宜的token

Anthropic宣布Claude Pro和Max订阅用户不得将额度用于第三方Agent框架,引发各方反应。Xiaomi MiMo大模型负责人罗福莉指出,当前token计费模式难应对挑战,需更优算力使用方式,还介绍了小米MiMo Token Plan。

机器之心
新闻资讯8

黄仁勋,开启智(Token)时代

全球大模型进入千万亿智(Token)时代,OpenRouter年化智用量突破一千万亿,对应推理支出约10亿美。黄仁勋在GTC大会提出「智(Token)经济学」,智成AI时代核心经济标尺,重塑产业规则。

新智元
新闻资讯8

更全面的具身智能真机评测来了!CVPR 2026 ManipArena挑战赛邀你打榜

具身智能产业发展迅速,但缺统一、高标准真机评测体系,成发展痛点。中山大学等机构推出 ManipArena 挑战赛,提供科学评测框架,已测部分模型,揭示不同技术路线能力边界,为产业发展提供基础。

机器之心
开源动态8

AI太难学?清华开源一批「学习虾」,免费的AI私教团来了

清华大学开源全球首个多智能体生成式学习AI技术框架OpenMAIC,它能将技术文档转化为零门槛学习课堂,还可解锁多种学习解法。其前身MAIC是重要学习平台,OpenMAIC功能强大,应用场景广泛。

CourseAI