人类在环」共找到 8664 篇相关文章

推荐文章7

翁荔最新博客:我们可能高估了模型,却严重低估了那层“脚手架”

前OpenAI安全研究副总裁翁荔新博客聚焦AI领域Harness Engineering。她认为Harness是决定模型现实任务中走多稳、多远的‘脚手架’,并梳理其演进路线,也指出研究面临评估、安全等瓶颈。

DeepTech深科技
产品应用7

Codex 推出 /goal 功能,不达目标,不罢休

OpenAI 为 Codex CLI 新增 `/goal` 功能,目标跨轮次保持活跃,同一个会话持续循。它有防护机制,防止无意义事上空转。虽然是实验性功能有局限,但改变了人和 AI 的协作界面。

AGI Hunt
推荐文章8

深度拆解 Claude 的 Agent 架构:MCP + PTC、Skills 与 Subagents 的三维协同

Anthropic Agent 工程领域不断创新,除了 MCP 外还推出 Skills 与 PTC 并 Claude 平台落地。本文深度拆解 MCP + PTC、Skills 与 Subagents 的定位、联系与应用,助你拓展构建 Agent 系统的思维。

AI大模型应用实践
算法论文8

ICCV 2025 | 机器人自主探索未知复杂空间?GLEAM破解主动探索建图的泛化难题

文章聚焦机器人未知复杂空间的自主探索建图难题。香港中文大学与上海人工智能实验室联合提出GLEAM,搭建GLEAM - Bench基准,设计通用策略,实现零样本适配未知空间,多指标上超越先前方法。

机器之心
算法论文8

桌面 Agent 的下一步:不是会操作,而是会调度工具

复旦大学和通义实验室提出 ToolCUA,让模型 GUI 与工具调用间编排路径。它从已有 GUI 轨迹合成训练数据,设计奖励机制, OSWorld - MCP 评测中效率与准确率大幅提升,为 CUA 发展提供方向。

深度学习自然语言处理
算法论文8

诺奖得主和Claude联手发论文,结论是:AI时代更需“笨功夫”

7月,诺奖得主乔治·帕里西与弗朗西斯科·赞波尼发表论文,借助Claude终结困扰领域十二年的猜想。此前帕里西批判AI,此次合作后态度转变,强调人机协作及人类独立思考的重要性。

DeepTech深科技
产品应用8

百亿向量,毫秒响应:清华研发团队向量数据库 VexDB 首发,攻克模型幻觉难题

9月25日,清华数智引航团队发布向量数据库VexDB,能支持百亿千维向量数据毫秒级查询,召回准确度超99%。它可解决大模型幻觉问题,已多领域深度应用,为企业AI转型提供方案。

AI前线
产品应用8

全域感知,一键部署:“星元智能体”开启国产AI落地新范式

4月29日,数字感知芯片技术全国重点实验室联合中星微团队发布‘星元智能体’。它基于XPU芯片,完成从芯片到智能体跨越,架构创新破算力瓶颈,还破解数据困局,已多地试点,未来将推动AI产业发展。

芯师爷
推荐文章8

明略科技吴明辉:企业级Agent的“精度陷阱”与人机协同重构之路

2025 年 12 月 19 日,明略科技创始人吴明辉 AICon 大会分享《可信 Agent 的规模化之路》。他指出企业级 Agent 存“精度陷阱”,建议重新设计人机分工,让 AI 执行 Task,人定义目标、校验结果、审计逻辑。

InfoQ
产品应用7

Agent上下文工程被Cursor玩出了新高度~

Cursor的agent为所有模型使用动态上下文,保持质量时更智能填充上下文。代码Agent改变软件开发方式,Cursor提出动态上下文发现模式,介绍了其中使用该模式的做法及优势。

PaperAgent