研究型智能体」共找到 5062 篇相关文章

算法论文8

大模化身苏格拉底:通过主动提问挖掘人机协作的深度

微软与南加州大学联合团队研究揭示激发大模主动提问能力新范式。通过定义主动信息收集任务、提出强化微调策略,经实验验证该方法有效,使模在多领域表现出色,重新定义大模角色。

AIGC开放社区
开源动态8

首发 | 陈天桥盛大团队,推出最强开源记忆系统EverMemOS

EverMind团队发布面向人工智能智能体的长期记忆操作系统EverMemOS。它在主流评测集表现超此前工作成新SOTA,受人类大脑记忆机制启发设计,有四层架构和三大特点,已开源,后续将推云服务。

机器之心
算法论文8

Sea AI Lab 揭秘:你费尽心力调的 LLM 一直在崩溃?罪魁祸首可能只是一个参数:BF16

Sea AI Lab 和新加坡国立大学研究指出,强化学习微调中训练不稳定和性能瓶颈,根源是数值精度 BF16。其低精度造成“训练 - 推理不匹配”,使训练易失败。将精度切换到 FP16 可解决问题,提升模表现。

AI寒武纪
新闻资讯7

奥特曼和量子计算奠基人讨论GPT-8

奥特曼在节目中与量子计算奠基人戴维・多伊奇就AI能否发展成有意识的超级智能产生分歧。奥特曼搬出GPT - 8举例试图说服对方,引发网友对AGI定义标准的讨论。

量子位
新闻资讯8

内幕曝光:OpenAI模坦承不会第六题,3人俩月拿下IMO金牌!

OpenAI三人团队俩月让AI达IMO金牌水平。他们用多智能体系统技术,使模能短时间解复杂问题。新模有自省能力,减少“幻觉”问题。此次突破是通用推理技术进步,未来将整合进更多模

新智元
算法论文8

SPIRAL:零和游戏自对弈成为语言模推理训练的「免费午餐」

新加坡国立大学等机构团队提出 SPIRAL,让模在零和游戏自对弈强化推理,摆脱人工监督。研究发现游戏可培养推理能力并迁移到数学,还开发系统保障训练,虽有局限但为 AI 发展指明方向。

机器之心
新闻资讯8

Cursor终结者?Grok 4正式登顶!马斯克扬言编程碾压,20万N卡年赚47亿美金!

时隔5个月,xAI发布通用模Grok 4,后续还将推编码、多模态代理和视频生成模。Grok 4已上线,有三个订阅版本。马斯克称其智能超博士生,在多基准测试中领先,编码或超Cursor。

InfoQ
产品应用7

R2没来,却等来综合性能更优的DeepSeek R1T2

抱抱脸热门排行榜出现R1变体模DeepSeek-TNG-R1T2,构建于多个父模之上,在智能与输出token长度间达新平衡点,速度快且测试表现佳,还给出与不同模对比的选择建议。

PaperAgent
算法论文7

Meta最新大模RL微调:在线DPO/GRPO显著优于离线DPO

Meta和NYU研究强化学习在大模微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合可验证与不可验证任务能提升性能,还给出不同任务的测试数据。

PaperAgent
新闻资讯8

WSL、Copilot皆重磅开源,深夜炸场的微软给我们带来了哪些惊喜?

今年微软 Build 2025 大会于 5 月 20 日凌晨开场,AI 是重要战略方向,‘开源’成关键词。大会有诸多亮点,如开源 Copilot 核心功能和 WSL,升级开发者工具,推出新智能体和平台等,还与多方探讨 AI 发展。

AI科技大本营