模型局限性」共找到 8154 篇相关文章

新闻资讯8

火线解析MiniMax招股书!全球领先大模型成本只有OpenAI 1%,果然拳怕少壮

上海大模型独角兽MiniMax通过港交所聆讯冲刺IPO。它是全球化AGI科技公司,全模态能力领先且成本低。技术上各模态模型表现出色,采用“模型即产品”模式获客,财务业绩向好,团队年轻高效。

量子位
开源动态7

DeepSeek开源新基础模型,但不是V4,而是V3.1-Base

昨晚深度求索宣布DeepSeek线上模型版本升级至V3.1,在Hugging Face发布新模型DeepSeek - V3.1 - Base。该模型是V3系列最新基础模型,发布后冲上Hugging Face热门榜第4位,社交网络看法不一。

机器之心
推荐文章8

对话 IDEA 张磊:「不以动作为输入条件,就不叫世界模型

本文是对IDEA研究院张磊的深度访谈。张磊在计算机视觉领域成就斐然,他指出具身智能落地需攻克成功率、泛化等挑战,大脑比本体更关键。还阐述了世界模型概念及应用,定义其应具备动作依赖等内容。

AI科技评论
产品应用8

跨机器、物体与各种任务!RoboScience发布通用具身大模型

RoboScience机器科学发布Visics通用具身大模型并披露VLOA技术架构。该模型从底层搭建全新具身基础表征单元,适配任意机器人、物体和任务。其由具身世界模型和通用操作模型组成,有强大泛化和操作能力。

AIGC开放社区
算法论文8

舍弃自回归,离散扩散语言模型如何演化?NUS综述解构技术图谱与应用前沿

本文介绍新加坡国立大学xML团队的论文,梳理离散扩散方向研究图谱,对比自回归局限与离散扩散优势,阐述数理基础、模型生态、训练与推理技术,还提及应用及未来方向,显示其对自回归范式的替代潜力。

机器之心
算法论文8

腾讯混元数字人团队发布Moral RolePlay基准,揭秘大模型的「道德困境」

腾讯混元数字人团队和中山大学推出「Moral RolePlay」测评基准,评估大模型扮演多元道德角色能力,揭示顶尖AI模型演不好反派,暴露模型理解社会心理复杂局限,还给出未来对齐技术方向。

机器之心
算法论文8

模型训练新突破!Meta提出LSP:无数据也能实现能力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了大模型训练的数据依赖难题。

新智元
新闻资讯8

模型七连发,外国人馋透了!阿里云栖大会全栈升级够狠

阿里在2025云栖大会全栈升级,发布七款通义新模型,从基础大模型到各专项领域全覆盖。旗舰模型Qwen3 - Max能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。

机器之心
算法论文7

AST| 西工大单湘淋、张伟伟等:基于湍流各向异分析与符号回归的改进型二阶非线涡粘模型

针对非线涡粘模型各向异建模难题,西工大单湘淋、张伟伟等通过雷诺应力各向异分析方法开展特征提取,构建新型二阶非线涡粘模型,在方形管道与矩形扩压器湍流测试中,精度优于现有模型

力学与人工智能
产品应用8

火山引擎 veFuser:面向扩散模型的图像与视频生成推理服务框架

近年来扩散模型在图像和视频生成领域取得突破,但 DiT 模型推理面临计算量大、模型多样、实时需求等挑战。火山引擎推出 veFuser 推理框架,能在图片和视频生成上实现低延迟、低成本的高质量体验,且未来会持续迭代。

InfoQ