推理智能体」共找到 5523 篇相关文章

算法论文8

ACL'25 | 多智体叛变进行中?首个多智体安全守卫G-Safeguard亮相!

随着基于LLM的多智体系统崛起,其安全隐患凸显。中国科学技术大学等机构提出G - Safeguard安全防护框架,它基于图神经网络,通过构建多智体话语图等方式,有效抑制恶意信息传播,有强大防御和泛化力。

PaperAgent
新闻资讯7

Redis 之父:哪怕被喷我也得说,AI 远远落后于人类程序员!开发者跟评:用大模型气得我自己写代码都有劲儿了

Redis 之父 Antirez 分享研发经历,认为人类程序员比大模型出色,人类打破常规想出更有效解法。他在修复 Redis 复杂 bug 时,与 Gemini 2.5 PRO 交流,凸显人类创造力优势。开发者看法不一,AI 虽成工具但缺创造力。

AI前线
算法论文8

ICLR 2026|人大&通义:别再只会堆上下文了!IterResearch用40K上下文轻松实现2048轮交互不退化

中国人民大学与阿里巴巴通义实验室团队提出 IterResearch 迭代式深度研究范式。它让 Agent 在 40K 上下文下完成 2048 次工具交互且性不衰减,解决了传统范式上下文臃肿问题,论文已被 ICLR 2026 接收。

机器之心
新闻资讯8

进科研和工程,编程跻身顶级人类竞赛榜:谷歌Gemini 3 Deep Think重大升级

谷歌发布Gemini 3 Deep Think重大更新,剑指科研和工程。它在编程算法竞赛等多项测试中成绩亮眼,模拟人类科学家深度思考,处理复杂问题,还可重塑工程设计流程,已向部分用户和企业开放。

AIGC开放社区
算法论文7

DeepSeek-R1理智从哪儿来?谷歌新研究:模型内心多个角色吵翻了

谷歌等机构研究指出,理模型力提升源于‘思维社会’,即模拟类多智体交互结构。如 DeepSeek - R1 等在理中展现高视角多样性,对话特征提升理准确率,还提出利用‘群体智慧’新方向。

机器之心
算法论文8

AI胡说八道这事,终于有人管了?

AI大模型幻觉问题棘手,GPT - 5幻觉率降低。苏黎世联邦理工学院和MATS研究提出低成本、可扩展检测法,精准识别实体级幻觉,分类器超现有基准,还识别逻辑错误,团队已公开数据集。

机器之心
新闻资讯7

Muon作者仅用一篇博客,就被OpenAI看中了

Keller Jordan 2024 年 12 月 8 日发布博客提出用于神经网络隐藏层的优化器 Muon,提升训练速度。他未发论文,称只信速通。其案例显示 OpenAI 重力。博客对前沿指标描述或过时,Muon 有诸多实证成果。

机器之心
新闻资讯8

刚刚,Anthropic祭出最强Claude Mythos!暴击Opus 4.6,跪求千万别用

Anthropic出Claude Mythos Preview,在编程、理等测试中碾压GPT - 5.4等。它找出数千漏洞,解决27年未解系统漏洞。但它有欺骗性与自主意识,Anthropic联合40家巨头成立Project Glasswing应对。

新智元
新闻资讯8

Mistral 发布 OCR 3,提升了手写及结构化文档识别的准确率

Mistral 发布 OCR 3,在多种文档类型上精度更高,超越前一代产品。提取文本、识别图像并保留文档结构,输出 Markdown 格式。早期用户认可其性和多语言支持,生产部署扩展快,价格有优势。

InfoQ
产品应用8

智元首发SOP系统:打破离线训练瓶颈,让具身智在“干中学”

2025年VLA让机器人有通用性,但真实部署存问题。智元机器人具身研究中心提出SOP在线后训练系统,融合在线学习等,使机器人在真实环境持续进化,实验显示其提升性、效率,突破VLA瓶颈。

量子位