「跨层级协同优化」共找到 1594 篇相关文章
字节&MAP重塑大模型推理算法优化重点,强化学习重在高效探索助力LLM提升上限
强化学习虽提升大语言模型表现,但面临探索难题。字节跳动等团队提出FR3E框架,分两阶段重建探索机制,在多数学推理基准实验中显著优于强基线,为大模型强化学习提供新范式。
微软发布多智能体 Web 操作系统!让 AI 成为真正“可控、协同、透明”的网页执行助手!
微软推出新一代多智能体 Web 操作系统 Magentic - UI,它能自动浏览网页、处理数据等,具备多智能体协同能力。其界面透明可控,功能丰富,安装使用友好,适用于多种复杂场景。
Diffusion约2倍无损加速!训练-推理协同的缓存学习框架来了| HKUST&北航&商汤
HKUST、北航与商汤提出HarmoniCa框架,解决Diffusion模型推理慢、成本高问题。它通过SDT和IEPO机制,解决训练 - 推理脱节,在多模型上实现推理提速、质量提升,且训练推理开销低,已开源。
网络顶会获奖!华为提出端网协同RDMA传输架构,解决大规模AI集群网络可扩展性问题
全球网络通信顶会 ACM SIGCOMM 2025 落幕,华为与港科大合作的 DCP 研究成果获奖。该论文提出数控分离传输架构 DCP,解决大规模 AI 集群网络可扩展性难题,实验显示其性能优于现有 RDMA 方案。
苹果应用商店ASO,如何优化下载转化率?如何提高App下载转化率?(进阶篇四)
流量探涨,ASO进阶篇,增长人的必备效率手册,带你升级为应用商店推广高手ASO进阶篇知识分为四章,今天更新第
推荐 4 个当下爆火的开源项目,Claude Code效率再翻倍
近期Claude Code相关开源库爆火,作者推荐4个项目。badclaude解锁官方工具限制,gstack将AI变虚拟工程团队,claw - code作者机智保下库,everything - claude - code优化AI编程体验。
Anthropic重磅更新skill-creator:创建skill全面告别“草台班子”时代
Anthropic升级skill - creator,让普通人创建skill更友好且有效。将测试等机制引入创作,能验证skill有效性。还支持多智能体并行测试、A/B测试,优化触发描述,为未来自然语言定义skill过渡。
陶哲轩DeepMind梦幻联动,最强通用科学Agent来了!一口气解决芯片设计、矩阵乘法和300年几何难题
谷歌DeepMind与陶哲轩等打造的AlphaEvolve是LLM驱动的进化编码Agent。它能优化计算生态、调度数据中心等,还解决了数学难题,已在谷歌内部使用,现开启早期邀测试用。
Agent 走向具身世界:从语言智能到机器人「大脑指挥官」
华为诺亚方舟实验室发布 RoboHarness 系统,解决不同策略协作问题。它将独立控制系统封装成可调度技能,由 Coding Agent 决策,还设计辅助技能和 Memory Bridge 模块,促进策略协同,推动具身智能发展。
西工大张伟伟等:强化学习如何练就近距空战制胜法则?| 航空学报CJA
本文针对空战智能化需求,构建高保真近距对抗仿真平台,提出优化自博弈强化学习架构。该智能决策系统与成熟飞行员近距格斗胜率超75%,为智能空战发展提供技术支撑。