「跨层协同优化」共找到 1818 篇相关文章
MCP实战|从0到1构建异步 DeepResearch 工具,支持进度推送与超时控制
本文借助开源项目,构建可在MCP Server中异步运行的DeepResearch,支持任务进度推送与超时控制。介绍项目架构、构建步骤、任务管理器实现要点及效果测试,还提及优化方向并给出源码。
当 AI 产品卷向同质化,支付成为最后的增长杠杆
AI应用商业化进入新阶段,头部效应显现,竞争同质化严重。支付成为关键变量,其复杂性远超预想,支付失败损耗大。优化支付需系统诊断,它是商业化基础设施,影响营收。全球支付格局复杂,Payinsider助力企业搭建支付架构。
华为云的组合新范式,引爆了Agentic AI应用革命
在2025全球计算大会上,华为云提出Versatile智能体平台与CloudDevice云终端协同方案,致力于破解大模型行业落地痛点。该方案激发AI端侧应用可能,释放云端潜力,已在多行业展现变革价值。
如何构建企业级数据智能体:Data Agent 开发实践
本文介绍DMS的数据分析智能体Data Agent,它从实验室走向企业生产一线,革新数据分析范式。文中剖析构建要点,对比与传统BI、高级分析差异,阐述技术内核优化及企业级能力,为开发实践提供参考。
快手提出强化学习创新框架RLEP,突破大模型推理瓶颈
OpenAI等模型用强化学习提升推理能力,但面临训练不稳定等挑战。快手Klear团队提出RLEP框架,引入经验回放技术,分经验收集和回放训练两阶段,还采用优化策略,提升大模型训练效率和性能。
无需人工标注!AI自生成训练数据,靠「演绎-归纳-溯因」解锁推理能力
新加坡国立大学等机构研究者提出元能力对齐训练框架,模仿人类推理心理学原理,将演绎、归纳与溯因能力融入模型训练。实验显示,该方法提升模型在多任务上的性能,且有跨领域可扩展性。
TRM思考奖励模型上线,大模型推理质量终于能量化了 | ICML‘26 Oral
大模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。
动动嘴,AI自己打开小红书、高德地图帮你干活了,国产Agent深度体验
作者为测试AutoGLM能否提高AHPU,用两个实测案例展示其功能,还拆解产品技术,介绍其进化历程。AutoGLM虽有不足,但已接近作者期待的产品形态,未来有望持续进化。
CVPR'26 | 以机器人为中心的ToM推理框架,从心智推理到决策行动
吉林大学、台湾大学和微软亚洲研究院联合提出MindPower Benchmark,构建以机器人为中心的ToM推理框架,统一建模环境感知、心智推理等,还构建数据集和评估指标。引入Mind - Reward强化优化,提升ToM决策与动作生成性能。
黄仁勋GTC开场:「AI-XR Scientist」来了!
英伟达CEO黄仁勋在GTC大会展示LabOS,这是全球首个融合AI与XR的协研科学家平台。它将多模态感知等技术融合,构建端到端闭环,还通过三大生物医学案例展示功能,开启人机协同科研新纪元。