通用推理」共找到 2676 篇相关文章

算法论文8

冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世

微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。

机器之心
算法论文8

ICCV 2025 | 机器人自主探索未知复杂空间?GLEAM破解主动探索建图的泛化难题

文章聚焦机器人在未知复杂空间的自主探索建图难题。香港中文大学与上海人工智能实验室联合提出GLEAM,搭建GLEAM - Bench基准,设计通用策略,实现零样本适配未知空间,在多指标上超越先前方法。

机器之心
算法论文8

北大-灵初重磅发布具身VLA全面综述!一文看清VLA技术路线与未来趋势

GPT-4o等多模态基础模型发展,让研究者探索将智能延伸到物理空间,VLA模型受关注。北大 - 灵初联合实验室从动作词元化视角提出新框架,分析主流action token,还介绍了VLA发展趋势及面临挑战。

机器之心
算法论文8

一篇95页最新80种Deep Research系统全面综述

浙大研究深度研究系统领域,分析自2023年以来80多个实现,提出4维度分层分类法,全面剖析4种实现架构,如单体、流水线、多智能体和混合架构,并阐述各维度演变与进步。

CourseAI
开源动态7

阿里达摩院开源多模态医学大模型—灵枢

大模型在医疗领域应用有医疗知识覆盖不足、幻觉风险高、推理能力欠缺三大难题。阿里达摩院开源统一多模态医学大模型灵枢,介绍其数据体系、清洗流程及四阶段强化训练方法。

AIGC开放社区
开源动态7

野生DeepSeek火了,速度碾压官方版,权重开源

近日,德国AI咨询公司TNG推出的「DeepSeek R1T2」模型火了,速度比R1快20%,性能不弱于R1。它采用AoE技术,融合官方三大模型,开源且在Hugging Face开放权重,获不少人期待。

机器之心
推荐文章8

Agent性能暴涨90%,刷榜GAIA可太容易了~

今年AI Agent层出不穷,当前研究缺乏统一标准、复现难。oppo Agent团队分享构建高效Agent的关键组件及刷榜GAIA的方法,从事实获取能力和逻辑推理保真度两维度分析,介绍了强化感知和提升思维的策略。

探索AGI
新闻资讯7

北大卢宗青:现阶段世界模型和 VLA 都不触及本质|具身先锋十人谈

北大卢宗青作为具身大脑创业者,认为现阶段世界模型和 VLA 未触及本质。他指出互联网视频数据是唯一可规模化的道路,其创立的「智在无界」正标注互联网视频中人类关节动作让模型学习。

AI科技评论
推荐文章8

Databricks × Snowflake 纷纷下注,PostgreSQL 成 AI 时代数据库标准?

文章结合作者对数据基础设施的实践与反思,探讨生成式AI时代数据系统的挑战与机遇。介绍数据基础设施新趋势,分析Neon、Supabase等公司受关注原因,指出PostgreSQL成行业标准,还提出Data Warebase概念及优势和应用场景。

InfoQ
算法论文8

微软再放LLM量化大招!原生4bit量化,成本暴减,性能几乎0损失

微软公布BitNet v2,性能几乎0损失,占用内存和计算成本显著降低。它首次实现对1比特LLMs的原生4比特激活值量化,通过H - BitLinear模块处理异常通道,实验显示其在多方面表现优异。

新智元