推理数据」共找到 4180 篇相关文章

算法论文8

X-SAM:从「分割一切」到「任意分割」:统一图像分割多模态大模型,在20+个图像分割数据集上均达SoTA

中山大学、鹏城实验室、美团联合提出X - SAM,统一图像分割多模态大模型。它将分割范式扩展,设计通用输入输出,采用端到端架构和三阶段训练策略,在超20个数据集达最优,为图像分割研究开辟新方向。

机器之心
产品应用8

GPT-5.2全力出击!碾压44类专业工作,实测编程同价位无对手、深度推理封神,但速度太拉胯了

GPT - 5.2 登场,有 Instant、Thinking、Pro 三个版本,在多方面大幅升级,能覆盖 44 类专业工作。它经济性强、编程能力佳、推理出色,但存在速度慢的问题,其价格 API 端有调整,未来还将推 Codex 优化版。

AI前线
产品应用7

Kimi K2.6背后的Agent Database:Agent-native 时代的数据 Infra 竞争,跟过去 30 年有何不同

TiDB Cloud 成 Kimi K2.6 供应商,为其 Agent 建站服务提供支持。Kimi K2.6 由 Agent 完成在线应用构建,与其他 AI 建站应用不同,它全托管且用户无需技术背景。该合作解决了成本和基础设施难题,展现了 Agent-native 时代数据 Infra 竞争的新特点。

InfoQ
推荐文章8

互联网免费数据已被吃光,普通人反馈早没用了?前英伟达工程师:Transformer的原罪浪费算力,聊天机器人把GPU全糟蹋了

前英伟达工程师、Sail Research 创始人 Neil Movva 认为当前 AI 行业陷“延迟陷阱”,AI 终局应是后台 Agent。他执行“算力拾荒者战略”,想降低智能成本,还指出 Transformer 架构有缺陷,互联网数据被吃光等问题。

AI科技大本营
开源动态8

智谱首秀工程实战经验!Coding Agent日均数亿次调用,GLM-5把长上下文推理的底层问题全逼出来了

今年 2 月智谱 GLM Coding Plan 上线后很受欢迎,随着用户和调用量上涨,Coding Agent 成压力测试场。4 月 30 日智谱发布博客,披露 GLM - 5 系列模型在超大规模 Coding Agent 调用场景下的底层推理技术突破及工程实践经验。

InfoQ
8

超越英伟达B200!AMD最强AI芯:1.6倍大内存、大模型推理快30%,奥特曼都来站台

AMD发布最强AI芯片MI350X和MI355X,号称大模型推理比英伟达B200快30%,内存是其1.6倍。该系列本月初已批量出货,还发布ROCm 7软件栈。AMD还预告明年推MI400系列,由其与OpenAI联合研发。

量子位
算法论文7

AMS最新AI4PDE综述:清华大学冯西桥教授团队白金帅等提出面向计算力学中物理和数据引导的AI框架的未来

本文综述人工智能赋能计算力学框架发展与现状,指出纯数据驱动、物理信息神经网络和算子学习方法虽有潜力,但在鲁棒性等方面有挑战。阐述四个研究方向,为复杂物理系统建模等开辟新途径。

力学与人工智能
算法论文8

10秒视频token超5万,O(n²)跑不动?用后训练线性化框架实现1.71倍加速,推理成本大降|CVPR'2026

视频生成进入大规模时代,但计算成本高,自注意力复杂度O(n²)跑不动。研究团队提出LINVIDEO后训练框架,无需数据和重新预训练,实现视频扩散模型线性化替换,保持生成质量,加速推理并降低成本。

量子位
算法论文8

OmniInsert:全新无掩码视频插入技术

基于扩散模型的视频插入技术发展快,但以往方法有局限。字节提出InsertPipe和OmniInsert,解决数据不足等难题。OmniInsert设计巧妙,还建立评测平台InsertBench,虽有小问题,但推理快,可加速优化。

带你学AI
算法论文8

RAG创新了,MCompassRAG装上了语义指南针

RAG系统存在chunk切分难题,现有方案有额外成本。MCompassRAG不切细、不rerank,给粗chunk加主题元数据当指南针,训练推理分离,实验显示信息效率提升、延迟降低。

PaperAgent