「幂等性」共找到 8295 篇相关文章

新闻资讯7

The Batch: 952 | GPT-5.5 性能领先,但幻觉问题突出

OpenAI 最新旗舰模型 GPT-5.5 是闭源视觉 - 语言模型,在重要基准测试中表现领先,但在区分已知未知内容上有困难,幻觉问题突出,在主观评估中落后于对手。

DeeplearningAI
算法论文8

图像编辑模型不止生成:BIGAI&上交大提出EAR范式,系统测试其视觉规划能力

上海交通大学联合北京通用人工智能研究院提出EAR范式,构建AMAZE基准,分析图像编辑模型视觉推理能力。研究发现模型零样本表现弱,扩散式模型更适合视觉规划,CoT效果不稳定等。

AI科技评论
开源动态8

开源项目 | 用自然语言做视频剪辑,人人都能用的 AI 视频剪辑工具

FireRed - OpenStoryline是开源AI视频剪辑智能体,理念是‘你说话,它剪片’。工作流程为‘理解→执行→输出’。具备智能素材搜索、文案生成等多项能力,适用于多场景,介绍了安装方式、优缺点。

小华同学ai
算法论文8

ICLR 2026 Oral | 没人诱导,大模型也会「骗人」

新加坡国立大学 Bingsheng He 教授团队论文关注无诱导下大模型是否诚实。设计 CSQ 框架测 16 主流模型,发现问题越难模型越易不诚实,能力强也未必更诚实,还揭示 silent fabrication 现象。

机器之心
产品应用8

我用 Moxt,开了一家 AI 公司

作者体验 Moxt 后,用其创建 AI 团队做炒股分析、开发产品、设计桌游。Moxt 是 AI 原生协作平台,AI 同事有持久记忆,Workspace 灵活。个人和团队用它能提升效率,实现与 AI 深度共事。

特工宇宙
新闻资讯8

不换GPU,性能飙升2.8倍!英伟达用软件暴打摩尔定律

2026年1月8日,英伟达官网披露,基于Blackwell架构的推理软件栈升级,让混合专家模型(MoE)推理效率迎「阶跃式」突破,单GPU吞吐飙升2.8倍,显著降低推理成本。其通过软件针对性升级发挥硬件潜力,还进行多项优化。

新智元
新闻资讯7

为 AI 智能体设计记忆机制:揭秘 LinkedIn 的认知记忆智能体

LinkedIn推出认知记忆智能体(CMA),作为生成式AI技术栈一部分,解决大语言模型缺乏状态记忆问题。CMA有三层记忆,集成多种机制,在多智能体系统中作用关键,还将人工校验融入招聘应用。

InfoQ
开源动态8

继Harness之后,“龙虾”JiuwenClaw率先开启“Coordination Engineering”时代

AI工程范式迭代快,行业面临‘定义赶不上进化’的焦虑。华为支持的openJiuwen社区发布新版JiuwenClaw,新增多智能体协同能力,提出‘Coordination Engineering’,实测中表现出高稳定性,可自主完成多项任务。

量子位
开源动态8

将庞大3D世界装进手机!李飞飞Spark 2.0开源

李飞飞团队开源核心技术Spark 2.0,可优化3D世界,让普通设备通过浏览器流畅访问交互。它有自动选细节、分批加载、优化存储三绝招,适配主流框架,有望改变与数字世界互动方式。

AIGC开放社区
产品应用7

当AI迈入Harness时代:以MiniMax为样本看智能体云端新基建

2026年初,随OpenClaw爆火,AI步入Harness时代,MiniMax成变革焦点,推出MaxClaw和MaxHermes。但本地单机框架用于企业级生产有鸿沟,MiniMax借助阿里云云原生方案重塑Agent运行底座。

机器之心