生产级Agent」共找到 3631 篇相关文章

7

突然变强!速度翻4倍,GPT Pro惊现「神」操作,网友怀疑GPT-5.5已就位

OpenAI悄悄完成GPT Pro模型升,其速度提升、视觉理解能力增强。同时,代号「Spud」的GPT - 5.5已完成预训练,发布在即,AI竞争将更激烈。

新智元
新闻资讯8

Claude Opus 4.7突然发布:逐字精准执行指令,软件工程和视觉能力大幅领先opus 4.6

Anthropic突然发布Claude Opus 4.7,重点提升软件工程能力,视觉能力也大幅跃升。指令遵循能力实质性提升,记忆能力改善。还同步上线新功能,升前需关注分词器和token输出变化。

AI寒武纪
新闻资讯7

Anthropic宣布练出神话模型:Claude Mythos,代码和黑客能力吊打opus4.6,不向公众开放!

Anthropic宣布Project Glasswing计划,因训练出超强模型Claude Mythos Preview。该模型代码和推理能力超opus 4.6,扫描主流软件发现数千零日漏洞。此模型不向公众开放,计划先在Claude Opus验证安全机制。

AI寒武纪
新闻资讯8

金融Agent再获近2亿加码!启明红杉高瓴集体押注,5个月内连获两轮融资

近日,讯兔科技完成近2亿元A轮融资,5个月内连获两轮。其核心团队有投研基因,产品Alpha派服务超8万投研人员。投资人看好其发展,认为2026年垂直领域AI应用将爆发。

量子位
新闻资讯8

全球首份大模型业绩报!MiniMax预判2026三大超PMF,AI平台公司启程了

港交所上市52天,MiniMax交出IPO后首份年报,2026年2月ARR突破1.5亿美元,2025年营收同比增158.9%,毛利飙升437%、亏损率收窄。它产品密集迭代,还预判2026年有三个超PMF,欲成AI平台型公司。

量子位
算法论文8

ICLR 2026 oral | AI代码真能进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」

过去一年大模型写代码能力提升,人们思考其能否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或成评估AI编程能力新工具。

机器之心
产品应用8

大模型API的大众点评来了:7×24小时实测,毫秒延迟智能路由,选API必备

清程极智推出的AI Ping像大模型API领域的大众点评,用7×24小时实测数据为开发者提供参考,解决信息差和重复劳动问题。它有持续评测榜单、智能路由匹配等功能,还统一了API度量衡,推动选型从经验走向数据驱动。

量子位
开源动态8

罗福莉执掌小米大模型首秀!定调下一代模型,全新MiMo-V2开源还横扫Agent第一梯队

在2025小米人车家全生态合作伙伴大会上,罗福莉首秀解读全新大模型MiMo - V2 - Flash,该模型已开源,采用MoE架构和MTP技术,在多方面表现出色,罗福莉还阐述其设计逻辑与对下一代智能体的看法。

AI前线
新闻资讯7

JetBrains放弃Fleet:急刹变道打造全新Agentic IDE,与VS Code、Cursor争夺下一代AI编程王座

本周,JetBrains 宣布停止开发 IDE 产品 Fleet,将精力投入新开发环境 Air。Fleet 自 2021 年推出一直处预览阶段,难取代 IntelliJ IDEA。公司称维持两条产品线易致用户困惑、分散精力。

AI前线
新闻资讯8

谷歌最新 Gemini Agent 爆击GPT-5.2?人类最后考试得分见分晓!网友:Altman又该发“红色警报”了

在全球人工智能竞争升温之际,谷歌与 OpenAI 同日更新。谷歌推出全新 Gemini Deep Research 工具,能力提升显著,还开源基准、推交互 API;OpenAI 发布 GPT - 5.2。两者竞争激烈,差距微小,都在争夺智能体框架标准主导权。

AI前线