新架构」共找到 4965 篇相关文章

新闻资讯7

深度解读 AGI-Next 2026:分化、范式、Agent 与全球 AI 竞赛的 40 条重要判断

文章总结了 AGI-Next 2026 活动上核心观点。指出模型分化是趋势,有 To B 和 To C 等场景差异;自主学习是范式;模型即 Agent,Agent 即产品;还分析了中美 AI 竞赛的现状与挑战。

海外独角兽
开源动态8

阿里开源电影级AI视频模型!MoE架构,5B版本消费级显卡可跑

阿里开源一代视频生成模型通义万相Wan2.2,含文生视频等功能。它率先将MoE架构用于视频生成扩散模型,5B版本可在消费级显卡部署。对比前代和Sora表现更优,还推出电影级美学控制系统。

量子位
开源动态8

华为开源7B多模态模型,视觉定位和OCR能力出色,你的昇腾端侧“甜点”来了

华为推出开源多模态模型openPangu-VL-7B,适配昇腾端侧。它推理性能性价比高,在多核心任务表现突出,技术报告还披露核心技术细节,为昇腾使用者带来选择,丰富昇腾生态。

量子位
新闻资讯7

GPT 4o-mini华人领队离开OpenAI:真正推动AI进步不是模型架构,而是互联网

前OpenAI研究员Kevin Lu加入Thinking Machines Lab,该公司2025年7月获约20亿美元早期融资,估值约120亿美元。Kevin Lu曾主导GPT - 4o mini发布,他认为真正推动AI进步的是互联网,而非模型架构

新智元
算法论文8

TPAMI 2026 | 北大彭宇团队提出CPL++框架,实现视觉定位模型的「自知之明」和「自我纠错」

北大彭宇教授团队提出CPL及进阶版CPL++框架。CPL用单模态匹配构造伪标签,引入静态验证模块;CPL++进一步自监督升级,具备纠错能力。实验显示,CPL++缩小了弱、全监督方法性能差距。

机器之心
新闻资讯7

OpenAI模型,被曝秘密训练中!万字硬核长文直指o4核心秘密

SemiAnalysis爆料,OpenAI正训练规模介于GPT - 4.1和GPT - 4.5间的模型,下一代推理模型o4基于GPT - 4.1训练。强化学习成推理模型进步功臣,但面临基础设施瓶颈,奖励函数难定等问题。

新智元
开源动态8

18.2K Star!macOS 丝滑跑Linux,一键容器、多架构支持,开发效率直接起飞!

介绍轻量级虚拟机管理器 `Lima`,它能在 macOS 上提供类似 WSL2 的体验,专注容器化工作流。支持多架构与多驱动,有开箱即用的容器化支持等特性,安装和使用简单。

开源先锋
新闻资讯7

为什么你的 Agent 总是出故障?从算力基建到可信熔断的架构生死线 | 直播预告

本次直播集结值得买、商汤、明略三位技术专家,拆解可信 Agent 构建之道。将探讨大模型基础设施、可信 Agent 架构、MCP 协议实战等问题,还会解答观众提问。

AI前线
算法论文8

告别噪声初始化:NTU MARS Lab提出A2A范式,实现机器人高性能单步动作生成

加坡南洋理工大学 MARS Lab 提出 Action-to-Action (A2A) Flow Matching 范式,以历史机器人轨迹为生成起点,打破生成速度与精度瓶颈,在训练效率、推理速度及泛化表现上佳,还可扩展至视频生成领域。

机器之心
算法论文8

首次披露!DeepSeek V3 发布软硬一体协同训练论文,公开「降成本」秘诀

DeepSeek团队发布论文《洞察DeepSeek - V3:规模的挑战和对AI架构硬件的思考》,从硬件架构和模型设计双重视角,探索其经济高效的大规模训练和推理方法,介绍了设计原则、低精度驱动等多方面内容及降成本秘诀。

AI科技评论