专家级表现」共找到 3393 篇相关文章

新闻资讯7

刚封杀就反杀!Claude逆天1400亿暴击OpenAI,250万人抛弃ChatGPT

Anthropic一路狂飙,全美市场份额飙至70%,年化收入近200亿美金。Claude表现强大,Claude Code爆火,众多巨头排队付费。但Anthropic与五角大楼冲突,或失去Palantir合作。同时,250万人“退订”ChatGPT,OpenAI紧急修约。

新智元
新闻资讯8

第一作者必须是AI!首个面向AI作者的学术会议来了,斯坦福发起

斯坦福大学宣布将于2025年举办科学AI智能体开放会议,投稿要求第一作者必须是AI,由其主导论文创作。会议评审主要用AI,人类专家最终评估。目标是探索AI驱动科研的未来,建立规范。

机器之心
7

星标超 29 万,OpenClaw 两天两次大更!适配GPT 5.4,告别“抽卡式 Prompt”

GitHub星标超28万的AI Agent开源项目OpenClaw,在周六与周日迎来两轮重量更新,集中在模型能力、Agent架构、工程部署及安全机制四个方向。2026奇点智能技术大会将邀专家探讨其产业实践价值。

AI科技大本营
算法论文8

将注意力旋转 90 度!今天,Kimi 的「注意力残差」火了

Kimi团队发布技术报告Attention Residuals,用依赖输入的注意力机制取代标准深度递归,解决传统残差连接的信息稀释和隐藏状态爆炸问题。实验显示其有计算优势,下游任务表现佳。

机器之心
算法论文8

零样本&少样本横扫12个工业医疗数据集:西门子×腾讯优图新研究精准定位缺陷,检测精度新SOTA丨AAAI 2026

西门子与腾讯优图联合团队提出AdaptCLIP通用视觉异常检测框架,不改动CLIP主干,引入轻量适配器。它兼容零样本/少样本推理,在12个数据集评估表现优,兼顾精度与部署需求。

量子位
新闻资讯8

字节发布全球首个预测未来基准FutureX,Grok-4 拿下冠军

字节跳动发布全球首个实时未来预测基准测试FutureX,杜绝模型作弊。在25个模型评测中,Grok - 4夺冠。它从多网站构建问题,分四难度。人类专家在部分等仍领先AI 。

AGI Hunt
开源动态8

MemOS:一种用于 AI 应用的记忆操作系统

大型语言模型缺乏记忆管理系统,限制其发展。MemTensor与高校联合开源MemOS,它将记忆视为可管理资源,有三层架构,系统化三种记忆类型。评估显示其在推理、检索、加速等方面表现优异。

PaperAgent
算法论文8

强化学习也能预训练?效果可提升20倍,华人新作引爆RL新范式!

伯克利团队提出新方法InFOM,不依赖奖励信号,能在多任务中超强迁移与推理。在36个基于状态和4个基于图像的任务测试中,InFOM表现出色,在jaco任务上改进达20倍。

新智元
产品应用8

模型换个Harness就「变笨」?EverMind把自进化从研究推向产品,让AI「越用越聪明」

同一模型换 Harness 表现或大幅波动,暴露自进化走向产品的两个关键问题。EverMind 用 HarnessBank、Raven 与 EverMe 解决,将自进化从研究推向产品,让 AI「越用越聪明」。

机器之心
算法论文7

AI穿越战争迷雾,72%的准确率化身中东冲突预言家

阿联酋和美国研究人员用中东冲突测试AI推理表现,发现其能看透利益博弈、预判战局演变。AI擅沿客观限制推演,在经济领域敏锐,政治领域较难,整体预测准确率达72%。

AIGC开放社区