多agent协作」共找到 6231 篇相关文章

算法论文8

ICML2025|宁波东方理工大学刘野,陈云天:DragSolver:用于真实汽车风阻系数估计的尺度Transformer方法

当汽车高速行驶,空气阻力影响车辆性能。传统风阻系数测算方法耗时久,难以满足实际需求。宁波东方理工大学等机构研究者提出DragSolver模型,能快速准确估计风阻系数,经实验验证效果优,有降本增效等价值。

力学与人工智能
开源动态8

Agent RL和智能体自我进化的关键一步: TaskCraft实现复杂智能体任务的自动生成

当前智能体训练缺高质量任务数据,主流数据集依赖人工标注,规模和复杂性受限。OPPO 研究院提出 TaskCraft 框架,能自动生成智能体任务,构建并开源含约 41,000 条任务的数据集,支撑智能体训练评估。

机器之心
新闻资讯8

TypeScript 之父 Anders Hejlsberg:别折腾“AI新语言”了,真正变天是 IDE 让位给 Agent

TypeScript 之父 Anders Hejlsberg 在与 GitHub 研究顾问对谈中回应质疑,称选 Go 重写编译器合理。他认为 AI 编程时代,TypeScript 语言服务将重塑,IDE 或让位给 Agent,还谈到 AI 在代码迁移中的应用及开源可持续性问题。

InfoQ
产品应用8

预算有限、技术空白:最刁钻的AI用户,是中小企业老板

2026年大模型在中小企业办公环境中应用不佳,工具与场景脱节。华为云推出专为中小企业的Flexus AI智能体平台,它依托自研模型,在场景准确率领先,已在行业验证效果,还能辅助内容创作。

InfoQ
新闻资讯8

马斯克发布“地球最强AI模型”Grok 4:横扫所有榜单,在“人类最终测试”超越人类博士”!

北京时间7月10日,马斯克团队发布Grok 4,其基准测试成绩惊人,在‘人类最终测试’等表现出色。它成功源于智能体协作、追求真相哲学和高算力投入,还在领域展现应用潜力,同时公布定价并坦言短板。

AI科技大本营
算法论文7

1美元Token撬动4800美元收益!AI挑战百万美元级基准,最赚钱的Agent出现了

Humanlaya Data Lab等机构构建$OneMillion - Bench评测基准,用经济价值衡量模型。它含400道高难题目,覆盖领域。目前最强模型能产出约50万美元价值,但离可交付专业任务还有距离。

机器之心
开源动态8

这个 skills 太硬核了,刚开源就斩获 1.7K Star!Agent 联网能力拉满!

AI开发者圈热议让AI助手真正“上网”,Claude Code原工具局限性大。web - access skill横空出世,从底层架构重新设计,解决其三大短板,让Claude Code可自由穿梭互联网,功能强大且安装使用方便。

开源星探
新闻资讯7

被高薪吸引却遭愚弄!科学家怒曝AI科研黑幕:为个人“捞金”,DeepMind百万成果是“垃圾”

物理学家 Nick McGreivy 分享应用 AI 做研究的经历,指出 AI 方法在解决偏微分方程上远不如宣传,如 PINN 效果差。还提到 DeepMind 成果遭质疑,研究存在数据泄露、报告偏差等问题,AI 加速科学或被夸大。

InfoQ
产品应用8

医疗幻觉率比DeepSeek低3倍,百川循证增强大模型横扫全球医学考试!

百川智能发布首个循证增强医疗大模型Baichuan - M2 Plus,将循证医学理念融入训练和推理,首创六源循证范式。其在场景评测中幻觉率低,国医考成绩优异,已上线百小应APP并开放API。

新智元
新闻资讯8

GPT-5.2果然反超谷歌Gemini 3 Pro!北大数院校友核心贡献

OpenAI在成立十周年推出GPT - 5.2,相比GPT - 5.1在实用领域更强,视觉理解等能力提升。ARC - AGI测试中得分超谷歌Gemini 3 Pro。拆解其方面能力,还介绍核心团队为数学专业新面孔。

量子位