视觉预训练」共找到 2680 篇相关文章

算法论文8

NeurIPS 2025 Spotlight | 让检索、推理真正「合体」的小而强模型,AceSearcher来了

近期,多所高校研究团队发布 AceSearcher 模型,它是让同一语言模型在推理时兼任双角色的合作式自博弈框架,以两阶段训练为骨架,将推理与检索结合,提升复杂检索任务效果,在多任务上表现出色。

机器之心
算法论文8

AI里最大的Bug,却也是人类文明最伟大的起点。

OpenAI论文指出AI产生幻觉是因其训练方式奖励瞎蒙行为。以考试为例,AI在信息不足时猜测是最优策略。还从统计学解释根源,指出解决幻觉需改变评估指标,也引发对人类想象力起源的思考。

数字生命卡兹克
开源动态7

24张图,从GPT-2到gpt-oss,看OpenAI开源模型技术演进

2025年8月OpenAI释出gpt-oss-20b与gpt-oss-120b两个开源权重模型。文章梳理了从GPT - 2到gpt - oss的技术演进,拆解关键创新点,对比了与Qwen3的差异,介绍训练推理细节、实测体验及与GPT - 5跑分对比情况。

PaperAgent
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十三】|GPT 架构如何工作 ?

本文是对GPT架构工作原理的解读。介绍了GPT与Transformer的关系,阐述其从输入文本到测下一词概率的流水线,详述训练和推理流程,还提及GPT架构进化的混合专家(MoE)模型。

AI大模型应用实践
算法论文8

推理即排序:ReasonRank反常识的2.7倍效率跃迁,新SOTA比快更快

论文提出新型排序模型ReasonRank,将深度推理能力融入排序流程,突破数据瓶颈,采用创新训练框架,效率比主流点对点排序模型快2.7倍,还介绍方法论、技术突破、实验验证等内容,指出局限与未来方向。

深度学习自然语言处理
产品应用7

豆包悄悄上线的这个新功能,也能用眼睛推理全世界了。

作者分享豆包新上线的视觉推理功能,在PC和手机场景使用体验良好。通过ChinaJoy图片、德爷相关图片、表情包等实例展示其推理能力,虽有软肋但很实用,还免费,体现出与其他工具的差距。

数字生命卡兹克
产品应用8

打造全球首个强化学习云平台,九章云极是如何做到的?

AI正从语言模型走向智能体,强化学习成关键技术,但训练面临困难。2025年6月九章云极发布全球首个工业级强化学习云平台AgentiCTRL,实现系统级重构,其智能基础设施战略布局领先,具产业赋能优势。

机器之心
开源动态8

英伟达世界模型再进化,一个模型驱动所有机器人!机器人的GPT时刻真正到来

英伟达GEAR实验室提出DreamZero,是基于训练视频扩散骨干网络的世界动作模型,有140亿参数,能让机器人通过文本提示完成未见任务。它解决了传统模型问题,在多方面表现出色,代码已开源。

机器之心
开源动态8

杨植麟带 Kimi 团队深夜回应:关于 K2 Thinking 爆火后的一切

上周,月之暗面发布并开源 Kimi K2 Thinking,主打“模型即 Agent”,一上线便引发关注。今日凌晨,杨植麟等人在 Reddit 开展 AMA 活动,回应 K2 Thinking 一系列问题,还回顾了其在多项测试中的亮眼成绩。

InfoQ
开源动态8

HF日趋榜一!真端到端模型AutoDeco终结手动调参解码

大语言模型手动调参解码繁琐,腾讯AI Lab王琰团队联合港中大(深圳)唐晓莹教授团队推出AutoDeco架构,通过创新训练策略让模型动态测解码参数,在多模型实验中表现出色且已开源。

机器之心