后训练系统」共找到 5130 篇相关文章

开源动态8

港中文联手美团开源“视觉推理通才”!图像视频10类任务一网打尽

香港中文大学MMLab与美团研究团队开源OneThinker模型,它可覆盖图像与视频十类核心视觉任务,在31项测试中表现出色,还展现泛化能力。研究团队搭建数据集,并引入EMA - GRPO算法提升训练稳定性。

量子位
推荐文章7

不自研、只收购,年入7亿美金,全球最赚钱的应用工厂是如何做成的?

Bending Spoons是欧洲非游戏类应用工厂,靠收购模式年入7亿美元。创始人Luca Ferrari称收购是买时间和优势,解锁被收购公司潜力。公司核心竞争力是内部系统,还回应了裁员争议,也谈及未来规划。

Founder Park
开源动态8

EMNLP 2025 | CARE:无需外部工具,让大模型原生检索增强推理实现上下文高保真

MetaGPT等机构团队发布CARE框架,可让LLM将推理上下文与自身检索能力结合,已全面开源。它提出原生检索增强推理范式,采用两阶段训练策略,在问答基准实验中表现出色,为解决模型问题提供新路径。

机器之心
新闻资讯7

宇树机器人被曝漏洞,机器人之间可相互感染,官方火速回应

宇树旗下多款机器人被曝存在严重无线安全漏洞,攻击者可借此实现最高权限控制,被攻陷的机器人还会自动扩散感染。发现者此前与宇树多次沟通无果公开漏洞利用工具链,宇树回应已着手修复。

量子位
推荐文章7

Shopify分享了他们做Agent的万字踩坑经验

Shopify分享构建生产级AI助手Sidekick的万字经验。构建中遇工具拓展难题,用JIT指令解决;评估是大挑战,建立严谨体系,虽有提升但效果仍有波动,模型还会钻空子,最强调单Agent系统也强大。

探索AGI
新闻资讯7

Anthropic再次声明:Claude降智问题已解决。网友:我累了……

Anthropic发布声明,称已解决影响Claude响应质量的两个问题,这是10天内第二次修复。此前Claude就出现过质量下降问题,引发‘降智阴谋论’,还让其失去一批订阅用户,且上次修复存在‘先瞒报’情况。

AGI Hunt
算法论文7

OpenAI新幻觉论文惹争议!GPT-5拉胯是测试基准有问题??

OpenAI新论文《语言模型为何会产生幻觉?》提出,模型有幻觉是因标准训练和评估流程倾向奖励“猜对”。GPT - 5不爱猜测,在榜单表现不佳,网友质疑论文是为GPT - 5挽尊,论文引发网友多方向讨论。

量子位
开源动态8

视觉Token注入CLIP语义,走向多模态理解与生成新范式

腾讯ARC Lab等机构提出全新视觉分词器TokLIP,将低级视觉Token与高级CLIP语义结合,支持端到端自回归训练,可接入LLM框架,降低计算与数据门槛,在多模态任务中表现优异,代码已开源。

量子位
新闻资讯8

刚刚,Sam Altman宣布:GPT-5即将发布

Sam Altman在X上宣布OpenAI通用推理系统在2025年IMO达金牌水平,同时透露GPT - 5即将发布。OpenAI研究员Alexander Wei介绍突破细节,模型解决多道题获35分。GPT - 5是实验模型,有金牌能力的版本还需等待。

AGI Hunt
推荐文章7

AI工具的真相与幻象:从客服看AI应用的理性边界

文章以某科技公司AI产品部门负责人张文的经历为例,讲述AI客服系统失败、AI编程助手成功的情况,指出AI应用存在期望与场景不匹配问题,还探讨了AI落地转变及组织搭建难题与解决办法。

InfoQ