无监督视觉推理」共找到 2596 篇相关文章

算法论文8

AAAI 2026 Oral|LENS:基于统一强化推理的分割大模型

文本提示图像分割技术有战略意义,但基于监督式微调的方法有泛化能力瓶颈。为此引入LENS框架,采用强化学习机制,还介绍其架构、奖励机制,该框架在测试中表现优异,代码已开源。

机器之心
新闻资讯8

SGLang 推理引擎的技术要点与部署实践|AICon 北京站前瞻

SGLang 是开源推理引擎,截至 2025 年 6 月,GitHub 近 15K Stars,月均下载量超 10 万次,被多个行业巨头采纳。InfoQ 专访其核心开发者尹良升,他分享关键技术等内容,6 月 27 - 28 日他将在 AICon 演讲。

InfoQ
产品应用8

实测爆火的阶跃星辰Step 3,性能SOTA,开源多模态推理之王

在 WAIC 2025 前一天,阶跃星辰推出新一代基座模型 Step 3,它是开源 VLM 新晋之王,性能超同类别开源模型,与顶尖闭源 VLM 也有一战之力。该模型具备多开好省特点,还展示了宏大技术生态与商业化布局。

机器之心
开源动态8

模仿人类推理修正过程,阶跃星辰提出形式化证明新范式 | 开源

阶跃星辰发布并开源形式化定理证明大模型 StepFun-Prover-Preview-7B 和 32B。采用两阶段监督微调、工具集成强化学习及 RL 与 SFT 迭代循环优化等策略,在基准测试集表现佳,还展示多个证明案例。

量子位
开源动态7

刚刚,OpenAI开源了两个大模型~

OpenAI开源基于GPT - OSS的安全推理模型GPT - OSS - Safeguard - 120B和GPT - OSS - Safeguard - 20B,用于安全用例。有安全推理训练、自带策略等亮点,适配不同显存,采用宽松许可证。

PaperAgent
新闻资讯7

推理之父走了!OpenAI七年元老离职:有些研究这里没法做

新年伊始,OpenAI研发副总裁Jerry Tworek离职,他是编程和两大核心技术路线奠基者,攻克LLM编程和复杂推理商业化难题。他称想探索在OpenAI难开展的研究。此前已有多位核心人才出走,OpenAI或因商业化与安全问题留不住人。

新智元
算法论文8

击败Meta登榜首:推理增强的文档排序模型ReasonRank来了

本文第一作者刘文涵聚焦AI搜索研究。提出推理增强的文档排序模型ReasonRank,在多个榜单击败多校和机构登榜首,其7B版本超越32B模型,论文获Huggingface paper日榜第一。还介绍研究动机、方法及实验结果等。

机器之心
算法论文8

We-Math 2.0:全新多模态数学推理数据集 × 首个综合数学知识体系

北京邮电大学、腾讯微信、清华大学团队提出We - Math 2.0,含知识体系、数据集及训练策略,可提升模型数学推理泛化能力。该成果在X上获关注,登Huggingface Paper日榜第一。

机器之心
新闻资讯7

谷歌「推理之王」也跑路Meta了,当年还是李飞飞挖来的

谷歌「离职潮」含金量提升,「推理之王」周登勇跳槽Meta。此前Noam Shazeer、John Jumper等也相继离开。谷歌全力「武装」AI Coding突击小队,重构Gemini训练方式,与原世界模型AGI路线冲突。

量子位
开源动态8

SGLang原生支持昇腾,新模型一键拉起无需改代码

12月20日SGLang AI金融π对收官,聚焦大模型推理效率。昇腾成SGLang原生支持后端,助DeepSeek等模型免调参运行。SGLang给出推理系统工程解法,昇腾与SGLang深度共建,性能优且全面拥抱开源。

量子位