视觉大模型」共找到 9277 篇相关文章

新闻资讯7

DeepSeek-R2!?神秘模型惊现竞技场,真实身份引网友猜测

模型竞技场秘密上线神秘模型steve,对话中它称来自DeepSeek。网友热烈讨论其身份,有R2、V4等猜测。同时,因CEO不满及可能缺芯片,DeepSeek的R2再度延期。

量子位
8

超越英伟达B200!AMD最强AI芯:1.6倍内存、模型推理快30%,奥特曼都来站台

AMD发布最强AI芯片MI350X和MI355X,号称模型推理比英伟达B200快30%,内存是其1.6倍。该系列本月初已批量出货,还发布ROCm 7软件栈。AMD还预告明年推MI400系列,由其与OpenAI联合研发。

量子位
算法论文8

均值至上假繁荣!北新作专挑难题,逼出AI模型真本事

当强化学习成模型后训练核心工具,主流方法陷入「均值优化陷阱」,推理能力停滞。北团队提出RiskPO,将风险规避理念融入优化目标,用MVaR+捆绑策略双管齐下,三任务表现优异。

新智元
开源动态8

智能必须基于世界模型?我们和蚂蚁灵波团队聊了聊

上周图灵奖得主 Yann LeCun 认为真正的智能应能在脑海推演,而语言模型难以触及真实世界。2026 年初,蚂蚁灵波连续四天开源四款具身智能模型,探索从物理交互构建智能的新路径。

机器之心
开源动态8

没想到,最Open的开源新模型,来自小红书

向来低调的小红书昨日开源首个自研模型 dots.llm1,它是中等规模的 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最,还介绍了数据处理、训练优化等多方面技术细节。

机器之心
算法论文7

开源中小模型+Skills也性能暴增!卢森堡学探索了小模型驾驭Skills的边界

卢森堡学等研究探索小模型驾驭Skills的边界。工业界因数据安全渴望开源小模型,智能体Skills框架让小模型性能暴增。研究拆解小模型处理复杂任务的方法,还验证不同策略有效性,发现代码专用模型优势。

AIGC开放社区
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁模型探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模型“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强泛化能力。

量子位
算法论文8

告别「利用率崩溃」:GIPO开启模型强化学习高效训练新方法 | ICML 2026

树根科技与三一集团团队联合提出 GIPO 算法,在机器人操控及语言/视觉动作模型强化学习训练中,缓解了策略滞后痛点,改善了 PPO 硬截断引发的‘利用率崩溃’问题。介绍了 GIPO 算法原理、优势及实验结果。

AI科技大本营
算法论文8

AI打假AI,拿下SOTA丨厦&腾讯优图

厦门学联合腾讯优图实验室团队提出AIGI - Holmes方法,创新性采用“模型+视觉专家”协同架构,解决现有AIGI检测技术瓶颈,在检测、解释能力及鲁棒性评估上均取得最优效果。

量子位
新闻资讯8

炸裂!Claude以第一作者写论文反驳苹果「推理模型根本没有推理能力」:苹果有三错误

苹果论文称推理模型无推理能力,引发争议。Anthropic的Claude Opus以第一作者写论文反击,指出苹果研究有混淆‘推理失败’与‘输出截断’等三问题,还通过实验证明模型能力,强调需更聪明评估方法。

AI寒武纪