「机器学习工程代理」共找到 2236 篇相关文章
Multi-Agent 的灵活编排之路
文章从Copilot 3.0架构规划模块出发,结合DeepSeek R1强化学习训练实践,探讨多智能体架构下大模型编排智能体解决问题。分析Copilot 2.0局限并介绍3.0升级,指出难点,展示效果对比及解决方案。
RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力
多模态奖励模型对提升多模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。
破除人形崇拜!京东用“狼族”军团重做物理AI
当行业狂热追捧人形机器人时,京东物流针对物流仓储非标环节自动化渗透率低的痛点,推出「狼族」异构机器人集群搭配超脑3.0智能中枢的全链路物理AI方案,已实现规模化落地,兼顾效率与经济性。
DeepSeek Harness规模化踩坑实录:耗时、成本、失败到底该怎么查
Agent 进入日常研发流程后,使用方关注耗时、Token 消耗和失败回溯。DeepSeek Harness(DSH)是开源 Agent 框架,腾讯云 Agent 可观测提供 DSH 采集插件,构成全景可观测方案,还介绍接入实践与其他能力。
打通AI4S数据入口:MinerU.Chem让化学文献中的“图片”,从“人类可读”走向“AI可用”
上海人工智能实验室 OpenDataLab 团队发布 MinerU.Chem 技术报告及成果,升级化学文献智能解析能力。它能将化学文献图片转化为 AI 可用数据,解决化学知识机器难用问题,在评测中领先,还将助力 AI4S 发展。
揭秘 | 桥梁缺陷检测新突破:模型压缩42%,精度几乎不掉
全国公路桥梁超百万座,传统人工巡检效率低且有安全风险,现有深度学习检测模型体积大、计算量高。研究团队提出LBSD - YOLO网络,通过创新实现轻量化,实验显示模型瘦身但性能不减,有重要应用价值。
GCEA-YOLO:给油田装上"防火眼",把抽烟行为检测精度拉高 20.8%
油田抽烟事故损失大,传统检测方法有局限,深度学习模型也面临难题。作者基于YOLOv11n构建GCEA - YOLO网络,含ADown、CSP - EDLAN、GFPN、EfficientHead四个模块,检测精度显著提升,还验证了泛化与稳定性,并给出复现代码。
跟上 AI 的节奏:为演进式架构构建上下文存储库
本文探讨AI辅助开发带来的上下文认知断层问题。在开发中,AI前期提效但后期难题凸显,企业面临团队执行和管理层决策层面隐患。可通过融合三大工程规范构建上下文存储库解决,确保开发逻辑可控。
对话许华哲:进家的机器人,先做好这10件事
本文是对许华哲的访谈,他离开星海图创办破壳机器人,切入具身智能C端赛道。许华哲阐述选择进家的原因、产品规划,还探讨数据来源、模型规划、强化学习等问题,分享从科学家到创业者的体验。
Agent = LLM + Memory + Planning + Tool Use
文章指出LLM设计无状态,产生幻觉,超长上下文窗口也无法解决记忆问题。介绍人类记忆的三个系统,阐述Agent记忆四层演化及每层问题,推荐开源项目Cognee将向量、图、关系型结合互补。