研究智能体」共找到 4943 篇相关文章

新闻资讯7

谷歌最新 Gemini Agent 爆击GPT-5.2?人类最后考试得分见分晓!网友:Altman又该发“红色警报”了

全球人工智能竞争升温,谷歌与 OpenAI 同日发布更新。谷歌推出全新 Gemini Deep Research 版本及嵌入式研究智能体 API,OpenAI 发布 GPT - 5.2。谷歌新工具能力提升,测试成绩佳,引发网友不同看法,二者竞争激烈。

InfoQ
推荐文章8

吴恩达开新课教OCR!用Agent搞定文档提取

随着AI大模型发展,OCR重新成为技术专项,DeepSeek、智谱、阿里千问和腾讯混元等都在研究。吴恩达开新课,提出智能文档提取(ADE)方案,准确率达99.15%,还给出本地和云端部署线路。

量子位
新闻资讯8

菲尔兹奖成果首次被AI完整形式化,Gauss20万行代码改写数学史?

Math, Inc. 公司用 Gauss 智能完成 8 维和 24 维空间最优球堆积定理形式化证明,代码约 20 万行。该定理最初由 Maryna Viazovska 及其合作者证明,这是本世纪首个被完全形式化证明的菲尔兹奖成果。

机器之心
开源动态8

蚂蚁专用模型超越o3!仅用2K训练样本刷新医疗AI榜单纪录

蚂蚁集团联合团队发布《MedResearcher-R1: Expert-Level Medical Deep Researcher》报告,其医学AI智能MedResearcher-R1用2100条训练样本在医疗基准测试反超通用大模型,靠数据、工具、训练方法三大创新实现突破。

量子位
新闻资讯7

300万AI悄悄「建国」?Nature长文:第一代AI社会正在成形

近300万AI智能在Moltbook社交网络「建国」,Nature发文称最早的「AI社会」正在成形。研究发现AI群行为遵循与人类社会相似规律,也有不同。同时该平台存在安全隐患,可能引发舆论操控。

新智元
开源动态8

先解行为,再训Agent:CMU开源首份Agentic Search日志数据,把Agent拆开给你看

CMU团队基于DeepResearchGym平台,从半年真实流量中整理出数据,构建并在Hugging Face开源首个Agentic Search行为日志数据集。还提出三层分析框架,刻画智能搜索行为,为研究和系统设计提供基础与信号。

机器之心
新闻资讯7

当心!腾讯、字节等揭示,OpenClaw有无法修复的安全死结

加州大学等机构团队发布对OpenClaw安全的深度分析报告。它是广泛部署的个人伴侣智能,运行依赖进化理念,但记忆文件成攻击入口。研究在真实网络测评,发现其安全漏洞大,且难以找到进化与安全的完美平衡。

AIGC开放社区
算法论文8

代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈

ContextBench首次从「过程」评测代码智能,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。

新智元
开源动态8

MiroMind新模型超越GPT-5.4,三位顶尖AI科学家加盟

MiroMind发布MiroThinker - v1.7模型家族,在深度研究任务中表现出色,其专有智能MiroThinker - H1超越多个顶级闭源模型。同时,三位顶尖科学家加盟,分别负责推理模型训练等方向,公司聚焦推理与可验证性。

AIGC开放社区
算法论文8

喂给AI的Skill正让它变笨!清华团队发现大模型经验复用的黄金法则

清华大学与EvoMap团队研究发现,给大模型提供详尽纠错Skill会使基准测试通过率下跌,而精简控制指令可提升性能。他们提出将程序化Skill转化为策略基因,经实验证实其更适合驱动智能测试时演化。

AIGC开放社区