后训练流程」共找到 4374 篇相关文章

算法论文8

ICLR 2026 | 7B小模型干翻GPT-5?AdaResoner实现Agentic Vision的主动「视觉工具思考」

文章介绍了AdaResoner模型,它学会‘何时用工具’,在拼图推理上击败GPT - 5。Google为Gemini 3 Flash引入‘Agentic Vision’,与AdaResoner殊途同归。AdaResoner有独特训练方法,提升小模型性能。

机器之心
算法论文8

清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026

大语言模型发展中,上下文长度成关键瓶颈,主流架构计算开销大。清华刘知远团队提出《InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation》,提出可切换注意力框架,为长上下文研究提供新思路。

AI科技评论
开源动态7

Clawdbot再次更名:新名OpenClaw,官宣支持Kimi K2.5和小米MiMo

两个月前Peter Steinberger搭建的项目,最初叫WhatsApp Relay,现获超10万GitHub星标、单周200万访问者。1月29日正式更名为OpenClaw,它是开源AI助手平台,此次发布新渠道、支持新模型等。

AI寒武纪
新闻资讯8

Clawdbot创作者Peter Steinberger首次公开亮相,讲述AI失控、被迫更名和拒绝VC的疯狂一周

Clawdbot创作者Peter Steinberger首次公开露面,在TBPN直播访谈讲述项目从诞生到失控全过程,披露被Anthropic要求更名细节,阐述对风投态度,描绘传统App将‘融化消失’的未来。

AI寒武纪
开源动态8

美团智能体SOTA模型LongCat-Flash-Thinking-2601开源

美团龙猫团队开源智能体推理模型LongCat - Flash - Thinking - 2601,总参数5600亿。该模型在多方面有卓越表现,团队通过构建数据、模拟环境、采用强化学习策略及设计高效架构等,使其比肩闭源模型。

AIGC开放社区
算法论文8

清华Nature发布惊人结论:AI写论文3倍速,但科学边界被锁死

2026年1月,清华徐丰力、李勇教授联合芝加哥大学团队在《Nature》发文,分析4100余万篇论文发现,AI提升科学家个人生产力,但收缩科学探索集体疆域。团队提出「全流程科研智能体系统」破局。

新智元
开源动态7

开源版 Cowork 项目在 X 爆火,创始人:感谢 Cowork,让我们三年的探索被看到

Anthropic的智能体工具Cowork在X上爆火,CAMEL AI的开源项目Eigent作为平替也跟着火了一把。文章复盘了CAMEL AI从2023年发布CAMEL框架到Eigent项目的三年探索经历,介绍了Eigent的产品设计、技术架构、应用场景及发展情况。

Founder Park
新闻资讯7

Anthropic 发布第四份人类经济指数报告:AI 对全球工作的影响仍然不均衡

Anthropic发布第四份经济指数报告,提出“经济基元”概念,用五个基础指标衡量AI使用情况。报告发现任务越复杂,AI加速效果越明显,不同国家使用方式有差异,还提及“去技能化”等情况及对生产力的影响。

AGI Hunt
新闻资讯7

GPT-5.2考赢人类!OpenAI警告:大模型能力已过剩,AGI天花板不是AI

GPT - 5.2在ARC - AGI - 2基准测试超人类,Poetiq系统让其准确率从60%提至75%。OpenAI称大模型进入‘能力过剩’阶段,未来AGI进展不止靠模型,更需人机协同。

新智元
推荐文章8

认知重建:Speckit 用了三个月,我放弃了——走出工具很强但用不好的困境

本文作者分享使用 Speckit 三个月的踩坑经历,探讨 AI 编程工具落地难题。介绍复合工程与上下文工程理念,提出 AI 工程化方案,对比传统工具,阐述其设计、落地策略及未来趋势,助力解决企业开发痛点。

腾讯技术工程