智能体训练」共找到 5155 篇相关文章

新闻资讯7

肖涵:2026 年的 AI 搜索就是智能记忆 | Elastic 中国 AI 搜索技术大会

2026 年智能记忆成 AI 基建新战场,虽概念不新但获前所未有的紧迫感。因智能任务变长但记性差,加记忆后又有记不住该记、忘不掉该忘的问题,遗忘成最大难题,产品分三条技术路线。

Jina AI
开源动态7

315 行代码构建编程助手,Go大佬揭开智能的「神秘面纱」

知名Go大佬Thorsten Ball用315行代码构建编程智能,虽无法与Claude、Gemini等编码功能媲美,但为初学者提供学习范例。文章分享构建步骤,包括准备工作、添加工具等,展示如何让智能与Claude对话及使用工具。

机器之心
算法论文8

挑战ReAct!MetaGPT团队提出ReCode智能新范式

DeepWisdom研究员指出当前主流智能框架受固定决策粒度束缚,提出ReCode新范式。它统一规划与执行,能在不同粒度间自由切换,实验显示其性能、成本和训练效率均有提升,引发广泛关注。

机器之心
产品应用7

Cursor 3 发布:IDE 不重要了,智能控制台上位,VS Code 这一套开始失效

Cursor 3 发布,用智能管理控制台取代传统代码编辑器,标志 AI 辅助开发工具与开发者工作流程重大转变。它带来多仓库支持、Cloud Handoff 等功能,转型源于竞争压力,业界对智能编排层架构设计未达成共识。

InfoQ
开源动态7

Stripe 发布基准测试:AI 智能可开发集成方案,但校验环节存在短板

Stripe推出基准测试套件,评估AI智能构建完整Stripe集成方案的能力,测试聚焦金融系统贴近生产环境的集成场景。测试显示,不同任务类型评测结果差异显著,核心瓶颈在于验证环节,当前智能短板在校验逻辑等方面。

InfoQ
算法论文8

邢波再出手:上次「骂」完世界模型,这次轮到智能

邢波教授新作《智能模型批评》上线 arXiv,质疑当下被称为「智能」的系统是否名副其实。论文将其分为两类,沿五维度拆解主流设计,提出 GIC 架构,还探讨了安全问题,指出要让能力内化进模型。

机器之心
开源动态8

首个面向科学任务、真实交互、自动评估的多模态智能评测环境,ScienceBoard来了

ScienceBoard是首个面向科学任务、真实交互、自动评估的多模态智能评测环境。它集成多领域科研软件,构建科研任务集合,评估智能在科学任务上的表现,发现现有模型在科研工作流中远未成熟。

机器之心
产品应用8

将科研脏活累活真·丢给AI!上海AI Lab推出深度科研智能FlowSearch

上海人工智能实验室推出深度科研智能FlowSearch,它由动态结构化知识流驱动,有三大核心模块。在多个科研基准上性能领先,能让科研更高效,标志科研智能迈向新阶段,还为未来系统奠定基础。

量子位
新闻资讯7

一场实战派圆桌实录:解码严谨行业智能落地的硬核突围|甲子光年

2025年7月28日,在世界人工智能大会相关论坛的圆桌对话里,来自不同行业的实战派探讨企业级AI智能落地。他们分享落地踩坑经验、应对数据等问题的办法,还预测了未来智能大规模应用的行业。

甲子光年
开源动态8

荣登HuggingFace周榜首位, 人大高瓴与快手提出ARPO实现智能高效训练

人大高瓴与快手提出的ARPO项目受高度关注,荣登Huggingface Paper日榜、周榜双首位。它是为多轮交互型LLM智能设计的强化学习算法,在基准测试中,用一半工具调用预算就显著优于现有方法。

PaperAgent