人在回路」共找到 8792 篇相关文章

算法论文8

SmartSearch:奖励驱动query精炼,让Agent中的RAG会“改错”

现有LLM搜索Agent忽视‘如何提问’致答案易出错。SmartSearch提出‘过程奖励+查询精炼’双机制,让Agent学会‘写不好就改’,代码已开源。经实验,它六数据集全面领先,各机制缺一不可。

PaperAgent
算法论文7

港中文 MMlab×美团新研究:仅用一个模型,应对多种视觉推理任务

港中文 MMLab 与美团联合提出 OneThinker 多模态统一推理模型,将多种视觉任务抽象为‘先推理、后作答’形式,通过多任务强化学习优化。实验显示其多任务表现佳,为通用视觉推理模型提供参考。

AI科技评论
开源动态8

【GitHub 10.9k star】DeepCode:把论文和需求文档“一键变代码”的多智能体开发神器,真能干掉手写样板?

DeepCode 是香港大学开源的多智能体开发平台,支持将论文、需求文档等转化为生产级代码。它能解决论文复现、原型开发等痛点,有多项特色功能,性能对比中领先,适用于多类场景。

小华同学ai
推荐文章7

MCP上下文爆炸怎么办?Anthropic给出了新答案(图文示例)

文章结合Anthropic和Cloudflare关于MCP的文章,指出MCP上下文过长存工具定义预加载和数据反复流经AI两个核心问题,提出让AI写代码调用工具的解决方案,包括按需加载工具和代码沙箱执行。

AI产品自由
算法论文7

断网后才发现脑子空空?132页论文实证:「脑腐」或成AI头号内伤

新智元报道,独立研究员Rénald Gesnot从多维度审视AI对思维的重塑。研究指出多数用AI时被「降智」,存认知卸载、「过滤气泡」、被「洗脑」等问题,还提出前进方向。

新智元
开源动态8

英伟达4段简短提示词,IOI夺金!开源模型也能征服最难编程竞赛

英伟达研究者提出GenCluster框架提升开源LLM解题能力,让开源模型gpt - oss - 120bIOI 2025获金牌级别高分。它执行‘海选+筛选+比拼+提交’流程,优势明显,标志开源AI里程碑式突破。

新智元
算法论文8

Nature重磅:AI和脑的根本区别找到了,我们对“聪明”的理解可能全错了

2025年《自然·机器智能》研究指出AI和‘泛化能力’上本质不同。类泛化靠抽象,学习高效;AI泛化靠统计,学习笨重。未来AI与应互补协作,而非谁取代谁。

AIGC开放社区
产品应用8

OpenAI编程新王GPT-5-Codex发布,7 小时搞定复杂代码,准确率飙升

OpenAI发布编程系统GPT - 5 - Codex,它是GPT - 5针对Codex产品的升级。能独立处理复杂编程任务,性能、代码审查、前端开发等方面表现出色,还有严密安全体系,驱动Codex产品生态升级。

AIGC开放社区
新闻资讯7

AI“画饼”画不动了?从狂热到冷静,行业迎来大消化

AI正处关键转折点,炒作撞上现实。企业认清其能力边界,期望回归理性。虽有泡沫讨论,但AI已部分领域产生影响。它迎来“iPhone 4时刻”,进入持续迭代阶段,放缓源于炒作与边际效益递减。

AI寒武纪
算法论文8

大模型破译甲骨文创下新SOTA!复旦团队推出新框架

复旦大学团队提出基于部首和象形分析的可解释甲骨文破译框架,构建PD - OBS数据集。该框架公开基准数据集上准确率高,零样本破译能力强,还能为未破译甲骨文输出可解释分析文本,助力考古工作。

量子位