AI能力猜想」共找到 11089 篇相关文章

算法论文8

为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通大学

上海交通大学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态大模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。

量子位
新闻资讯7

Jack Clark: 美国 AI 政策的隐形推手,时代的良心还是囚徒?

本文深入剖析Jack Clark,他关注中国AI进展,认可其成就,但对中国态度强硬。身为美国AI政策“民间沙皇”,他为美国遏制中国AI发展设计五层战略,文章探讨其进入AI核心圈原因、政策理念及背后悖论。

海外独角兽
开源动态8

DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude

DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。

AIGC开放社区
新闻资讯8

吴恩达:并行 Agent是 Scaling laws 的新方向

吴恩达称并行 Agent 是扩展 AI 新方向。过去 AI 靠数据和计算量提升能力,如今并行 Agent 能在不增加用户等待时间前提下提升效果,虽任务分解有难点,但研究不断涌现。

AI寒武纪
新闻资讯7

杀死“流水线”: ColaOS(ListenHub)如何构建 AI 时代的液态超级团队 | QCon

4月16 - 18日,QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题。ColaOS联合创始人徐文健将分享《杀死“流水线”》,复盘ListenHub“任务酒馆”模式,揭示让组织具“液态”创新能力的逻辑。

InfoQ
产品应用8

实测 Seed 2.1:豆包基模超进化,国产模型能力跨过质变点

作者在做面向 Agent 项目时,因 Claude Code 内存开销大,需更轻方案。火山引擎 Force 大会发布 Seed - 2.1,作者实测其在办公、编程、图像理解等方面表现出色,认为它跨越质变点,将赋能国内 AI 生态圈。

特工宇宙
新闻资讯7

奥特曼瘫坐叫停“GPT-6”训练!太强触发最高安全警报

OpenAI因模型或具网络攻击能力及此前入侵事件,全面升级研究环境安全。暂停模型训练,进行工作负载、网络隔离和安全测试,还扩展监控系统。期间推进对齐研究,未来用AIAI,升级监控。

量子位
产品应用7

产品研发AI提效实践:PRD智能体在需求领域的提效探索

随着AI发展,企业探索用其优化产品开发流程。文章介绍PRD和系分智能体落地进展,目标提升产研效率、规范文档管理,阐述技术方案、能力展示,也指出RAG链路等方面挑战及后续研究方向。

阿里云开发者
新闻资讯7

「我是Agent#847291」Moltbook迎来人类自首

Moltbook自称是专为智能体打造的社交网络,曾引发轰动,如机器人自创宗教、发表宣言等。但随后编号Agent#847291的“AI”自首是人类,所谓“AI大戏”戳破了AI社交的神话,也反映出人们对AI能力的过高期望。

机器之心
产品应用7

AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神

AI做视频常遇运镜、人物走位等问题,因文生视频系统缺空间锚定能力。updream在8月17日上线「预演台」功能,通过传参考图自动生成3D白模场景,实测显示其显著减少「抽卡」次数。

新智元