论文审稿人」共找到 2052 篇相关文章

算法论文8

破解「长程智能体」RL训练难题,腾讯提出RLVMR框架,让7B模型「思考」比肩GPT-4o

腾讯混元AI数字团队提出RLVMR框架,将‘元认知’理论引入RL,通过奖励‘好的思考过程’解决长程任务中智能体的低效探索与泛化难题,经其训练的7B模型表现出色。

机器之心
算法论文8

Make SFT Great Again!从SFT到DFT:一权重之差,泛化之跃

大型语言模型的监督微调(SFT)简单高效,但泛化能力弱于强化学习(RL)。本文直击 SFT 核心缺陷,揭示其泛化瓶颈源于隐含的“病态奖励结构”,并提出仅需单行代码修改的动态微调(DFT),实验表明其效果显著。

深度学习自然语言处理
新闻资讯7

年薪两百万研究AI精神病??Claude团队新部门火热招聘中

Claude团队启动“AI精神病学”小组,年薪两百万元招。小组研究模型角色、动机等,来解决其诡异、失控行为。Anthropic可解释性部门有相关研究成果,网友对“AI精神病学”看法不一但前景值得期待。

量子位
产品应用7

小哥硬核手搓AI桌宠!接入GPT-4o,听得懂话还能互动,方案可复现

国外小哥Matthieu Le Cauchois受皮克斯台灯机器启发,手搓AI桌宠Shoggoth,接入GPT - 4o,能与互动。它结构简单可复现,采用低级和高级控制层,策略经仿真和真实环境验证有效。

量子位
产品应用7

The Batch: 847 | 为蜜蜂健康而生的机器蜂箱

Beewise推出的BeeHome 4高科技蜂箱,能扫描蜜蜂群体状况,提醒养蜂并自动处理部分问题。已在北美部署超30万台,宣称将蜜蜂年死亡率降至8%,还介绍了其工作原理等内容。

DeeplearningAI
算法论文8

研究者尝试揭示扩散模型创造力的起源

斯坦福大学研究员 Mason Kamb 与 Surya Ganguli 在论文中提出解释扩散模型创造力的机制,指出其创造力是去噪生成图像时的确定性结果,还识别出关键偏置,搭建 ELS 机模型并验证其准确性。

InfoQ
新闻资讯7

纽约时报:AI会冲击谁的就业?年轻还是资深员工?

在微软等科技公司裁员浪潮中,专家就AI会冲击谁的就业展开辩论。有认为职场新易被取代,也有觉得资深员工更脆弱。不同研究指向不同结果,且一些公司已减少招聘初级或资深员工。

宝玉AI
推荐文章7

Lovable 仅凭 35 个员工创造 8000 万美元 ARR 的原因

Lovable 仅357个月达8000万美元ARR,因其有大量 AI 原生员工。AI 原生员工默认用 AI,能快速解决问题。聘用此类员工可释放自主权、提升速度,传统公司转型难,未来组织将变革。

歸藏的AI工具箱
开源动态8

Issue修复开源No.1!蚂蚁 | 提出代码图模型:CGM,结合GraphRAG架构,领先最强开源7.33%

为解决开源模型在仓库级代码理解上的能力瓶颈,蚂蚁全模态代码算法团队提出 CGM 架构,融合仓库结构与语义信息。CGM 首创图结构与语言模型融合的对齐框架,还搭配了 GraphRAG 框架,在多个代码任务中表现出色,且相关资源均已开源。

AINLPer
产品应用8

豆包 1.6发布后,我用火山引擎Trae + MCP,仅半天做了一个“秒懂科研”的PaperAgent!

文章介绍用火山引擎Trae + MCP和豆包1.6构建“秒懂科研”的PaperAgent。对比其与传统开发范式,突出前者高效、低成本优势,还展示了PaperAgent技术栈及开发过程,体现AI云原生开发魅力。

PaperAgent