「AI Agent Harness」共找到 10664 篇相关文章

算法论文8

不止修bug:Agentic Coding评测走向复杂feature交付新阶段

中国科学院自动化研究所联合华为提出 FeatureBench,构建端到端基础设施并开源。它从单元测试出发构造评测任务,引入多种机制保障任务可执行、可验证,能有效区分模型能力,还提供易用的评测流程。

机器之心
新闻资讯8

第二代AI预训练范式:预测下个物理状态

英伟达科学家 Jim Fan 发布《第二代预训练范式》,指出当前以 LLM 为代表的第一代范式应用于物理世界时「水土不服」,认为第二代范式是「预测下一个物理状态」,引发机器学习社区讨论。

机器之心
推荐文章7

Cursor 重新定义 Agent:脑子再大,不如会翻书。

Cursor 分享博客指出,Dynamic Context Discovery 效果远好于 long context 方式,开启动态上下文可使总 Token 消耗降 46.9%,还能减成本、降延迟、提准确率,但也存在成本转嫁、工程复杂度高和安全风险等问题。

探索AGI
算法论文8

华为发布如何利用RL训练强大的Deep Research Agent综述!

华为技术团队发布综述论文,首次系统性梳理利用强化学习(RL)训练强大的深度研究代理。论文指出传统SFT和DPO方法有局限,RL优势明显,还在数据构建、算法设计等方面给出进展与路线图。

深度学习自然语言处理
推荐文章7

企业数字化转型新引擎:MCP + LLM + Agent 架构赋能!

本文介绍MCP(Model Context Protocol)模型上下文协议,它是Anthropic于2024年11月底推出的开放标准,可统一大模型与外部数据源和工具通信协议,打破数据孤岛,有诸多优势,还适用于多个场景。

MCP Server
推荐文章8

入职OpenAI啦!这是我的AI Research面试指南

作者分享入职OpenAI的面试经历、经验与建议。涵盖身心调适、通用建议、各环节应对技巧等,如提前准备、与朋友模拟、注意设备和细节等,助读者应对AI Research面试。

深度学习自然语言处理
算法论文8

自我进化Agent综述:通往超级智能的进化之路

当前大型语言模型面对新知识、动态环境时存在固定参数瓶颈,自进化智能体研究应运而生。本论文作为该领域首部系统性综述,提出革命性框架,解析自进化智能体技术脉络与未来挑战。

深度学习自然语言处理
产品应用7

这个百万月活的 AI 社区,做成了「二次元版 Sora」

文章介绍了百万月活的AI社区「捏Ta」,它类似「二次元版Sora」。其独特之处在于受年轻人喜爱、规避真人肖像问题、玩法多样。产品功能降低创作门槛,覆盖全流程,形成活跃社区生态。

特工宇宙
新闻资讯8

华为算力“公共事业”:“超节点+全栈开源”如何撬动AI未来?

文章围绕华为算力“公共事业”展开,介绍其“超节点 + 全栈开源”模式。华为通过推出系列算力芯片、构建“超节点 + 集群”方案、全面开源开放软硬件等举措,满足全球产业算力需求,推动AI产业变革。

InfoQ
开源动态8

南洋理工、北大、上海AI实验室开源长记忆世界模型

目前世界模型模拟方法在维持长期一致性上有挑战,南洋理工大学、北京大学王选计算机技术研究所、上海人工智能实验室联合开源长记忆世界模型WORLDMEM,介绍了其记忆机制、基础架构、训练技术及检索策略等。

AIGC开放社区