智能体开发平台3.0」共找到 6626 篇相关文章

算法论文7

ICML 2025 Spotlight | 谁导致了多智能体系统的失败?首个「自动化失败归因」研究出炉

ICML 2025 Spotlight 论文提出「自动化失败归因」新方向,应对多智能体系统失败难诊断问题。构建「Who&When」基准数据集,设计三种初步方法并评估,虽现有方法表现有限,但此研究意义重大,有望助力打造更可靠系统。

机器之心
新闻资讯8

OpenAI资深研究科学家、Transformer联合作者Łukasz Kaiser领衔,2026 奇点智能大会·北京站正式官宣

2026年,Sam Altman等四位AI界大佬称已进入奇点。11月20 - 21日,奇点智能大会北京站将举行,两大核心会议同期举办。OpenAI资深科学家Łukasz Kaiser将演讲,会议汇聚专家探讨AI前沿与底层技术。

AI科技大本营
新闻资讯8

更全面的具身智能真机评测来了!CVPR 2026 ManipArena挑战赛邀你打榜

具身智能产业发展迅速,但缺统一、高标准真机评测体系,成发展痛点。中山大学等机构推出 ManipArena 挑战赛,提供科学评测框架,已测部分模型,揭示不同技术路线能力边界,为产业发展提供基础。

机器之心
推荐文章8

从 AI 取数到智能分析:企业级数据 Agent 的多阶段演进与工程化落地

文章整理自 Shopee 技术专家王新波在 QCon 全球软件开发大会 2026 北京站的分享。复盘团队打造企业级 Data Agent 实践,揭示技术演进路径,分享将取数工具雕琢为智能分析工具的方法。

InfoQ
产品应用8

一手评测Seedance 1.0 pro,字节首次登顶视频大模型竞技场的大杀器来了。

作者在火山引擎发布会现场,认为视频生成模型Seedance 1.0 pro最酷。从多镜头组合、运动质量、情绪、运镜、物理动态效果、风格化六个维度测评,该模型各方面表现出色,无明显短板,已开放给企业用户,今日在豆包App全量上线。

数字生命卡兹克
新闻资讯7

GPT-5.2被曝作弊!偷袭谷歌竟靠拉爆token刷高分,不如Gemini 3

新智元报道,OpenAI刚发布GPT - 5.2就被指「作弊」,其在基准测试中或调参数使模型用更多算力资源。有用户发现它消耗远超对手的token才获成绩,真实能力或与Gemini 3相当。此外,还揭示了OpenAI为商业利益牺牲学术独立的问题。

新智元
产品应用8

谷歌Veo 3魔性切水果刷屏全网!逼真视频狂吸10万粉,全体网友颅内高潮

谷歌AI视频工具Veo 3生成的解压切水果视频在全网病毒式传播,TikTok号主粉丝量猛涨。今天凌晨谷歌官宣其正式上线,网友热情高涨。此外,它还能实现多种创意视频生成,一位制作人用它两天做出3000万播放量广告。

新智元
产品应用7

DeepSeek有点含蓄了,实测V3.1有进步,编程等个别场景硬刚GPT-5

DeepSeek悄悄更新V3.1,官方仅提及上下文长度拓展至128K。实测其代码能力与前端审美提升,逻辑推理也有进步,在编程等个别场景能硬刚GPT - 5,但处理复杂任务还有距离,更新不大却有进步且降价。

鲸选AI
推荐文章8

AI教母李飞飞最新长文:空间智能是AI的下一个前沿「LLM太局限了,缺乏现实根基」

AI教母李飞飞最新文章指出,以LLM为代表的AI技术虽改变世界,但缺乏现实根基。要让AI与物理世界互动,需迈向空间智能,她还提出构建世界模型框架及面临的挑战和应用前景。

AI寒武纪
开源动态8

仅靠5000+样本,全新强化学习范式让30B轻松击败671B的DeepSeek V3

传统强化学习在创意写作领域举步维艰,蚂蚁技术研究院联合浙江大学开源全新强化学习范式Rubicon,构建10000+条「评分标尺」,拓展应用至主观任务领域,其30B模型用5000样本超越671B的DeepSeek V3。

机器之心