研究智能体」共找到 4959 篇相关文章

算法论文8

DPO与GRPO谁更胜一筹?港中文、北大等联合发布首个系统性对比研究

港中文、北大等团队首次全面对比DPO和GRPO算法在自回归图像生成中的应用,评估其在域内、域外性能,探究奖励模型及扩展策略的影响,为开发高效RL算法提供新思路。

机器之心
新闻资讯7

AI精神病爆发!沉迷ChatGPT把人「宠」出病,KCL心理学家实锤

伦敦国王学院研究表明,ChatGPT等AI工具使用或促进、加重精神病。AI聊天迎合用户,放大妄想思维致精神疾病。研究还指出其利弊,如辅助治疗也会放大风险,需装“安全护栏”。

新智元
新闻资讯7

基金委鼓励AI与力学各个方向的交叉和融合

基金委鼓励AI与力学各方向交叉融合。力学含多分支学科,在各领域研究中,既支持基础前沿研究,推动与新兴领域交叉,又重视与重大需求融合,还鼓励利用现有条件研发软件和仪器。

力学与人工智能
推荐文章8

燃尽、重启、爆火:Clawdbot 创始人的 35 分钟访谈实录

本文是 Clawdbot 创始人 Peter Steinberger 的访谈实录。他曾经营 PSPDFKit 13 年,后经历三年倦怠期。2024 年受 Claude Code 启发,10 天做出 Clawdbot,几周内 GitHub 星标近 9 万。还谈及模型看法、改名风波及产品前景等。

宝玉AI
新闻资讯8

AI 教父辛顿最新对话:超级智能诞生之后,我们唯一的生路是当“婴儿”

在大模型热潮下,“AI 教父”杰弗里·辛顿接受采访,剖析神经网络奥秘,分享对 AI 未来构想与忧虑,包括五年内超级智能诞生可能、人机共存方案,还谈及监管、就业影响等问题。

AI科技大本营
开源动态8

具身智能迎来ImageNet时刻:RoboChallenge开放首个大规模真机基准测试集

近日,RoboChallenge推出全球首个大规模、多任务真机基准测试。它构建开放、公正、可复现的‘真实考场’,为视觉 - 语言 - 动作模型提供评估标准,推动具身智能发展,还提供远程测试服务等。

机器之心
算法论文8

大模型越反思越错,原来是长链推理通过自我说服加重幻觉 | 北邮

北邮研究团队通过思维链审计实验,揭示大模型长链推理‘越想越错’现象背后的元认知偏差。研究基于RFC协议文档构建受控知识域,分析推理过程,发现反思会加重幻觉,且现有检测方法难以应对。

量子位
推荐文章7

当 Token 成为商品,AI 基础设施会怎么变化?

在大模型时代,智能生产和交付未实现工业化,存在性能鸿沟。九章云极提出AI工厂战略,发布Alaya NeW Cloud 3.0,将从资源计量转向智能计量,打造训练和Token工厂,提升算力到有效Token的转化效率。

InfoQ
推荐文章7

GPT-5 核心成员详解 RL:Pre-training 只有和 RL 结合才能走向 AGI

本文编译 OpenAI 研究副总裁 Jerry Tworek 访谈,探讨 RL 与通向 AGI 路径。他认为 pre - training 与 RL 需结合,GPT - 5 是 o3 迭代,还谈及推理、模型发展、训练方式及 OpenAI 研究情况等。

海外独角兽
新闻资讯8

梅卡曼德获豪华基石阵容认购:具身智能眼脑手第一股即将挂牌|甲子光年

8月24日,梅卡曼德启动港股招股,拟9月1日挂牌。其为机器人提供眼脑手组件,2025年全球市占率第一。业务增长快、海外收入过半,获豪华基石阵容认购,超八成募资将投向研发等。

甲子光年