统一模型框架」共找到 8641 篇相关文章

算法论文8

Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升

当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。

PaperAgent
新闻资讯7

具身智能机器人年度总结,来自英伟达机器人主管

英伟达机器人主管Jim Fan在2025年末判断机器人领域仍处蛮荒时代。他指出该领域缺乏统一评测体系,硬件进展快但可靠性不足限制软件迭代,VLM→VLA技术范式有问题,还分享了数据、模型等方面情况。

量子位
算法论文8

CVPR 2026|1分钟单图变4D视频!AI看图直接脑补物理规律

北京理工大学和理想汽车等团队提出全新框架PhysGM,引入DPO实现端到端快速前馈推理,能1分钟内将单图生成为4D动态视频,在速度和评价指标上超越主流模型,相关工作被CVPR 2026接收且代码已开源。

机器之心
算法论文8

TPAMI | DC-SAM:打破SAM交互限制,基于循环一致性的图像与视频上下文分割方法

北京邮电大学联合南洋理工大学等机构发表论文,提出 DC - SAM 框架及 IC - VOS 基准。DC - SAM 含特征融合、正负双分支循环一致性提示生成等部分,实验在多基准测试获 SOTA 性能,为视觉大模型落地提供方案。

机器之心
产品应用8

当搜索遇见 AIGC:京东零售的“千人千面”素材生成实践

在 AIGC 浪潮下,视觉生成技术重构电商生态。京东零售李岩介绍“千人千面”商品素材生成技术链路,包括关键模型及实现框架,还发布焕新版京点点平台并预告新能力,推动电商个性化变革。

InfoQ
新闻资讯7

算力极限下,OpenAI 急着做什么?

OpenAI联合创始人兼总裁Greg Brockman接受专访,就产品战略收拢、新基座模型Spud等议题给出内部判断,回应业界质疑。他称产品调整是算力硬约束下的优先级排序,还透露了产品核心方向和Spud进展。

机器之心
算法论文8

RAG搜对了却答错?德国萨尔大学找到了真相丨ACL'26

RAG是大模型落地标配技术,但存在搜到文档却答错的痛点。德国萨尔大学等团队提出Disco - RAG框架,在‘搜’和‘答’间加入‘读懂’环节,已被ACL 2026主会录用,在多基准测试表现优异。

量子位
产品应用7

Spring AI 实战|Spring AI入门之DeepSeek调用

文章介绍Spring AI框架,它简化企业数据或API服务与大模型集成,降低开发复杂度。还给出调用DeepSeek的实战步骤,包括手动请求、代码自动发起、实现流式响应等,也提及OpenAI starter的兼容性及生产环境监控。

阿里云开发者
产品应用8

社区供稿 | GLM-4.5技术博客:原生融合推理、编码和智能体能力

文章介绍 GLM-4.5 和 GLM-4.5-Air,二者旨在统一推理、编码和智能体能力。在 12 个基准测试中表现良好,采用 MoE 架构等技术,还开源 slime 框架。文中展示其多方面应用,并说明使用方式。

Hugging Face
新闻资讯8

谷歌最新 Gemini Agent 爆击GPT-5.2?人类最后考试得分见分晓!网友:Altman又该发“红色警报”了

在全球人工智能竞争升温之际,谷歌与 OpenAI 同日更新。谷歌推出全新 Gemini Deep Research 工具,能力提升显著,还开源基准、推交互 API;OpenAI 发布 GPT - 5.2。两者竞争激烈,差距微小,都在争夺智能体框架标准主导权。

AI前线