稳定性提升」共找到 3030 篇相关文章

产品应用7

Claude Fable 5.1 发布:缓存读降价 75%,但实际更贵了

Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1。Fable 5.1 性能全面上涨,但出现价格悖论,缓存读降价 75% 实际更贵。在 Agent 类任务与 Opus 5 基本持平,推出 EFS 应对数据留存争议,还有多项科研演示。

AI工程化
算法论文7

Transformer上限触顶,Mobius能否引发下一代模型架构的革命?

自ChatGPT问世,Transformer上限备受关注。前OpenAI、Google负责人称其走到尽头。国内改进架构受算力限制。上海人工智能实验室的书生Mobius团队提出分离知识与推理的架构,有望解决商用等关键问题。

机器之心
产品应用7

视觉AI从「会生成」走向「能创作」,RabbitVis探索AI应用新范式

随着AI生图能力提升,如何让AI进入创作流程成新问题。兔展智能基于UniWorld - Design视觉AI大模型推出RabbitVis,推动视觉AI从图片生成走向可编辑、可交付的创作流程,解决创作流程断点问题。

机器之心
开源动态8

别让AI一上来就“进厂打螺丝”:智源悟界·Orca要先教模型理解世界如何变化

智源研究院悟界·RoboBrain Orca Team发布技术报告Orca,探索模型是否理解世界状态变化。Orca尝试在统一世界潜空间学习状态与规律,受海外关注。它先学世界表征,有独特学习方式,经实验验证效果良好。

量子位
新闻资讯7

AI让科研人发了3倍论文,但科学本身正在收缩:什么才是科研人真正需要的AI?

2026 年研究显示,用 AI 工具的科学家发文量是不用者 3.02 倍,但科研主题覆盖面缩减、虚假引用增多。通用 AI 提升效率却动摇科研基础,爱思唯尔 LeapSpace 注重可信度与发现力,已开放免费试用。

DeepTech深科技
新闻资讯8

用脑机接口上班是什么体验?一个渐冻症患者使用了两年后表示:其实很无聊

加州大学戴维斯分校团队为渐冻症患者凯西植入脑机接口,装置工作 19 个月处理 18.3 万个句子,证实其长期稳定性和临床实用价值。不过,脑机接口难以兼顾多方面要求,商业推广也面临诸多门槛。

DeepTech深科技
7

Cursor 1.5T新模型放弃Kimi基座!600亿美元股票换Cursor,马斯克第一刀砍向微软GitHub

SpaceX官宣收购Cursor,后者获600亿美元股票。Cursor在Compile大会发布1.5T新模型和Origin平台。新模型规模大、从零训练、算力提升;Origin是面向智能体的Git平台,将与GitHub竞争。

InfoQ
算法论文8

蚂蚁EGSS算法破解Test Time Scaling困局 | ACL 2026

蚂蚁集团CodeFuse团队在ACL 2026主会论文中提出EGSS算法,破解Test Time Scaling困局。该算法精准识别高不确定性决策点,解决计算冗余与选择脆弱问题,在SWE - Bench - Verified上全模型提升5 - 10%。

量子位
开源动态8

离谱……面壁让 AI 写了个训练框架,然后它自己训出了最强的 1B 模型:MiniCPM5-1B

面壁发布 1B 参数量级最强端侧文本大模型 MiniCPM5 - 1B,其 Base Model 由 AI 编写的训练框架 ForgeTrain 训出,速度超英伟达 Megatron 10%。该模型性能出色,部署门槛低,数据治理方案对应数据集也已开源。

AGI Hunt
算法论文8

Qwen3-VL-Seg 深度解读:当多模态大模型学会"像素级精准手术",仅用0.4%参数碾压8B模型

文章深度解读阿里通义实验室发布的Qwen3-VL-Seg,它解决开放世界指代分割问题,用仅17M参数(占基础模型0.4%)在4B规模超越8B模型。介绍其原理、架构、数据、实验结果,还给出实战代码。

机器学习AI算法工程