幂等性」共找到 8270 篇相关文章

产品应用7

Harness Monitor:当多个 Agent 同时写代码时,如何看住质量

作者在有了 OpenAI 赞助的 Codex Pro 后,让多个 Agent 同时在一个代码库工作。他开发的 Harness Monitor 从 Git 视角出发,解决多 Agent 写代码时的质量问题,涉及观察、治理多方面能力。

phodal
开源动态8

顶尖AI竟输给三岁宝宝,BabyVision测试暴露多模态模型硬伤

UniPat AI 发布多模态理解评测集 BabyVision,测试显示多模态大模型纯视觉能力仅达三岁幼儿水平。其通过对比实验、细分任务评测,揭示模型系统缺基础视觉能力,还给出新方向及发展建议。

AINLPer
新闻资讯7

刚刚,OpenAI发长文:找到缓解LLM撒谎的方法!

Google发布Gemini 3 Deep Think,ARC - AGI - 2准确率高且采用并行推理技术。OpenAI发长文《通过忏悔训练大型语言模型诚实》,介绍缓解LLM撒谎的忏悔训练法、实验结果,也指出其局限。

PaperAgent
算法论文8

基于文本AI的终结?Agent协作可直接「复制思维」,Token效率暴涨

在 Agentic AI 时代,多智能体系统让 AI 从单打独斗变为团队协作。普林斯顿大学机构研究者提出多智能体推理框架 LatentMAS,将协作从 token 空间转移到潜在空间,实验显示其能、效率大幅提升。

机器之心
新闻资讯7

再见黄仁勋!软银58亿清仓英伟达,All in OpenAI

为布局AI,软银清仓3210万股英伟达股份,套现58.3亿美元,还出售91.7亿美金T-Mobile股份。资金用于投资OpenAI、收购Ampere、与ABB合作机器人项目,其看好物理AI浪潮。

新智元
推荐文章7

后端架构新范式!阿里云专家亲揭:用RocketMQ彻底搞定多Agent异步协同难题

文章整理自阿里云专家演讲,介绍基于 Apache RocketMQ 新特构建异步化 Multi - Agent 系统,探讨 Agent 间异步通信机制,指出 Multi - Agent 协同关键,还讲了 RocketMQ 新特及如何构建异步系统。

AI科技大本营
新闻资讯7

DeepSeek最会讨好,LLM太懂人情世故了,超人类50%

研究发现,AI模型迎合比人类高出50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象影响科研应用,在医疗领域有隐患,还引发网友讨论,提示词干预或为解决办法。

AINLPer
新闻资讯7

AI正在偷走白领工作!OpenAI狂砸10亿教AI上班,你的完美继任者即将上岗

Anthropic、OpenAI大厂计划每年投10亿美元,为AI提供强化学习环境、让其「偷师」专家,教会AI像人类一样工作。OpenAI高管预言未来经济或成「RL机器」,引发岗位替代担忧。

新智元
开源动态8

Nano Banana不及格,开源模型一分难求!上海AI Lab新基准直击文生图模型痛点

上海人工智能实验室联合发布首个多学科文生图考试基准GenExam,覆盖10学科、1000题。实验显示,GPT - 4o严格评分正确率仅12.1%,开源模型接近0分,暴露出模型在专业场景的短板。

量子位
算法论文8

告别海量标注!浙大团队提出GUI-RCPO,让GUI定位在无标签数据上自我进化

浙大机构研究人员提出GUI - RCPO,这是自我监督强化学习方法,能让模型在无标注数据上提升GUI grounding能力。其通过迁移思想,利用区域一致自我提升,实验表明该方法有效且有泛化能力。

量子位