科研新范式」共找到 4297 篇相关文章

新闻资讯7

OpenAI内部大重组!模型行为团队并入Post Training,负责人另起炉灶

OpenAI对模型行为团队重组,其创始负责人Joanne Jang组建OAI Labs,探索人与AI协作范式。模型行为团队约14人并入Post Training,OpenAI还完成系列人事调整。

量子位
推荐文章7

AGI 暴论:强化学习的「GPT-3 时刻」实现,还需要 1 万年?

国外AI初创公司Mechanize三位创始人联合撰文称,RL或迎“GPT - 3时刻”,但需数千至上万年“模型处理任务所用时间”训练。还提出“复制训练”范式,能磨炼模型能力,补足短板。

AI科技评论
算法论文8

ICLR 2026|在「想象」中进化的机器人:港科大×字节跳动Seed提出WMPO,在世界模型中进行VLA强化学习

香港科技大学 PEI - Lab 与字节跳动 Seed 团队提出 WMPO 范式,可让具身智能在‘想象中训练’,解决传统 VLA 训练瓶颈,目前论文、代码与模型均已开源。

机器之心
开源动态8

如何科学地“设计”SFT 数据?一次关于 ODA 的完整平台级验证

大模型后训练阶段,SFT数据构建常依赖‘直觉’或‘试错’。上海人工智能实验室OpenDataLab团队发布报告,基于OpenDataArena提出范式,将数据集构建从‘随机艺术’变为‘确定性工程’,并进行平台级验证。

深度学习自然语言处理
新闻资讯8

梁文锋叫停签约,DeepSeek百亿融资或全面暂停;白宫控月之暗面蒸馏Anthropic Fable 5遭驳;腾讯员工晒317万年终奖被辞永不录用|Q资讯

本文汇总一周AI行业热点,有DeepSeek百亿融资或暂停、Karpathy或从Anthropic离职等消息,还涉及腾讯、360、美团等公司动态,以及多个模型发布与技术成果。

InfoQ
新闻资讯7

GAIR Live 预告|从 IROS 2025,看智能机器人前沿趋势

IROS 2025 近日在杭州闭幕,作为全球机器人领域盛会,展示具身智能突破与方向。GAIR Live 将携手学者与产业领军者,通过线上直播解读其核心趋势,拆解研究范式转向,还设有多个热门话题探讨。

AI科技评论
算法论文8

西湖大学提出RDPO强化学习框架,实现扩散模型并行推理加速

扩散模型“顺序去噪”特性成速度提升瓶颈。西湖大学AGI Lab提出RDPO框架,不必改动模型本身,优化其“采样导航系统”,在多基准测试中取得领先图像生成效果,解决加速问题并提供RLHF对齐范式

量子位
算法论文8

Relink:为GraphRAG动态构建证据图

大语言模型在开放域问答中有‘幻觉’问题,GraphRAG结合LLM与知识图谱缓解此问题,但现有方法有缺陷。作者提出‘推理并构建’范式和Relink框架,实验显示其性能领先,对RAG系统设计有启示。

PaperAgent
新闻资讯7

没PhD,算什么AI研究员!LeCun论文竟要28岁辍学生审批,发文「暗讽」内讧升级

Meta内讧升级,首席科学家LeCun发帖疑似暗讽上司Alexandr Wang。LeCun列出“研究员”学术标准,点明研究与工程不同。此前Meta重组,TBD Lab审核FAIR论文,两者理念冲突,FAIR科研独立性受挑战。

新智元
新闻资讯8

刚刚,Anthropic官方Cluade 5使用指南发布

Anthropic发布Claude 5的Context Engineering官方指南,指出为Claude Opus 5和Claude Fable 5删掉Claude Code超80%的system prompt,在编码评估上无明显损失。还揭示6组范式反转及四类上下文载体分工。

PaperAgent