性能跑分」共找到 2656 篇相关文章

算法论文8

DeepSeek-V4蓄势待发!梁文锋署名论文或开启第二个DeepSeek时刻

据报道,DeepSeek将于2月发布新一代旗舰模型DeepSeek V4,其编程能力或超Claude和GPT系列。最新论文提出Engram条件记忆机制,离死记硬背与逻辑推理,揭示新稀疏性配定律。

AIGC开放社区
算法论文8

跳出「黑盒」,人大刘勇团队最新大语言模型理论与机理综述

大语言模型工程成功但理论研究滞后,被视为「黑盒」。人大刘勇团队用生命周期类法,将LLM理论研究整合为六阶段,系统综述底层理论与机制,指出前沿挑战,为其向严谨科学转型提供路线图。

机器之心
产品应用8

《生成式AI卓越架构设计指导原则》:从"能用AI"到"用好AI"

在2025云栖大会上,阿里云发布《生成式AI卓越架构设计指导原则》,以云原生“卓越架构五大支柱”为基础,针对大模型内容合规与安全治理等领域提建议,助力企业从‘能用AI’走向‘用好AI’。

阿里云开发者
新闻资讯8

英伟达、英特尔和AMD芯片同台竞技:CES 2026各自都展示了怎样的实力

全球最大消费电子展CES 2026上,英伟达、英特尔和AMD发布新品,AI算力芯片竞争演变为平台架构全面战争。英伟达推Rubin计算平台,英特尔发布第三代酷睿Ultra系列,AMD展示Helios平台及相关产品。

AIGC开放社区
算法论文8

多模态推理新范式:上海AI Lab新作证明“画”出答案比“说”出答案更靠谱

上海人工智能实验室等联合提出DiffThinker模型,利用扩散模型构建全新视觉推理范式。它在视觉中心任务上表现优异,准确率碾压GPT - 5等模型,还能与MLLM协同推理实现1 + 1 > 2的效果。

深度学习自然语言处理
算法论文8

港大联合字节跳动提出JoVA: 一种基于联合自注意力的视频-音频联合生成模型

香港大学联合字节跳动提出视频 - 音频联合生成框架 JoVA,支持音视频 Token 跨模态交互,引入嘴部区域特定损失解决口型同步问题。实验显示,它用约 190 万条数据就达先进水平。

机器之心
开源动态8

即将开源 | 阿里云Tair KVCache Manager:企业级全局 KVCache 管理服务的架构设计与实现

阿里云Tair KVCache团队联合多团队将开源Tair KVCache Manager,介绍其架构设计与实现。该服务应对Agentic AI下KVCache存储挑战,解决传统模式难题,具备企业级管理能力,后续还会完善多方面功能。

阿里云开发者
推荐文章7

4000 Star,Vibe Coding终级指南:胶水编程

Vibe Coding由karpathy提出,本文享其终极指南。介绍了胶水编程、方法论精要、工具资源、编码模型性能级参考等内容,还给出架构与工作流程,建议选第一梯队模型处理复杂任务。

PaperAgent
新闻资讯8

摩尔线程的野心,不藏了

上市15天后,摩尔线程在首届聚焦全功能GPU的开发者大会上,围绕MUSA推出诸多新品,包括新GPU架构、芯片、智算集群和硬件产品,还将开源核心组件,构建生态,其架构创新定义未来AI产业格局。

量子位
新闻资讯7

OpenAI发布权威AI科研基准,扯下AI遮羞布:奥赛金牌≠一流科学家!

OpenAI在2025年12月16日发布FrontierScience基准,用超700道题从物理、化学、生物维度考验AI科研推理能力。评测竞赛和研究赛道,初测显示GPT - 5.2领先,但前沿模型仍有诸多问题。

新智元