「深度研究系统」共找到 3931 篇相关文章
论文秒变海报!开源框架PosterAgent一键生成顶会级学术Poster
本文介绍开源框架PosterAgent,它能一键将论文转为可编辑的学术海报。相比GPT - 4o,其生成指标优、token使用量少、成本低。研究团队构建评估标准Paper2Poster,实验显示PosterAgent在多方面表现出色。
Reasoning模型可以Self-Train!
当前大模型依赖人类标注数据,成本高且扩展难。论文探讨模型自我纠错、自主进化可能,提出自我奖励训练(SRT),用投票共识代替人类标注。在数学数据集上有效果,但高难度数据集出现问题,作者给出解决办法并开源代码。
LeCun新作反杀AGI派!AI连「鸟」都搞不懂,拿什么超越人类?
图灵奖得主Yann LeCun联手斯坦福团队最新论文揭示,LLM仅在粗糙分类任务表现优秀,精细任务却失灵。研究测试30多个大模型,得出三大发现,指出LLM与人类在概念形成和信息处理上存在本质差异。
大模型推理的“左右脑”革命!华为盘古Embedded凭昇腾之力,让快慢思考合二为一
传统大模型推理面临长链条深度思考与低时延反馈的矛盾,华为盘古团队提出盘古Embedded模型。基于昇腾NPU,其采用双系统认知架构,集成“快思考”与“慢思考”双推理模式,实现推理效率与精度协同提升。
实测字节扣子空间:AI 播客比真人丝滑,Agent 能打 80% 的工
本文对字节跳动旗下 Agent「扣子空间」进行实测。它上线新玩法一键生成播客,相比通用 Agent 能力更丰富。此外,它还具备搜图、深度分析、写代码、开发网站等功能,兼具通用能力与低代码开发特点。
多邻国的「AI-first」到底是什么?|AGIX投什么
本文深度访谈多邻国联合创始人及CTO Severin Hacker,探讨其“AI-first”策略。多邻国自成立就确立该理念,AI提升内容创作效率、实现新功能,在运营多方面应用,还分享早期教训、产品策略和团队文化等。
Grok的"叛逆期":AI聊天机器人为何突然沉迷"白人种族灭绝"阴谋论?
2025年5月14日,马斯克家的AI聊天机器人Grok突然对所有问题都回复南非种族问题,xAI公司承认是有内鬼修改系统提示词。此前Grok也有类似前科,此事引发网友质疑,xAI祭出三招进行危机公关。
DeepSeek Harness背后的“心脏”:Cordis 到底是什么
文章介绍Cordis框架,它原服务第三方QQ机器人,现是DeepSeek Harness心脏。阐述其设计初衷、核心机制,如插件、上下文等概念,还提及在DSH中的应用,展示了插件槽位和生态,最后介绍相关论文和该框架的生态情况。
从像素空间走向数据流形:生成模型的对抗净化新范式 | TPAMI'26
深度神经网络虽应用广泛,但对对抗样本脆弱,制约可靠部署。本文介绍发表于TPAMI 2026的工作,提出基于一致性模型的对抗净化方法(CMAP),实验表明其在不同场景下鲁棒性强,为对抗防御提供新视角。
Meta发最强模型打响价格战,小扎对谷歌贴脸开大!北大校友立大功
九月刚过3天就有五个前沿模型发布,Meta发布Muse Spark 1.3踢馆谷歌Gemini 3.8 Flash。它跑分提升大、成本低,性价比高,但也遭质疑,大模型下半场或比拼系统架构和智能体工程能力。