「策略基因」共找到 927 篇相关文章
千星项目LLMRouter:多模型路由,16+策略优化推理
UIUC开源智能模型路由框架LLMRouter,可自动为大模型应用选最优模型,有16+路由策略。该框架打通训练、评测等链路,解耦Route与Training模块,支持多轮协同等,还可插件式扩展。
蒸馏效果起飞!DOPD破解「特权幻觉」,让在线策略蒸馏更有效
近期,新加坡国立大学等团队提出 DOPD 法解「特权幻觉」难题。该法依 token 情况动态蒸馏,实验表明其在 LLM、VLM 蒸馏效果好,鲁棒性强,训练稳定,为在线策略蒸馏提供新思路。
多智能体自主规划模式性能提升:五大精准策略详解
本文基于多智能体React模式实践,剖析自主规划架构挑战,如工具调用延迟等。提出五大优化策略,像用流式XML替代FunctionCall、合理压缩上下文等,还介绍创意加速器AI绘画创作功能,为多智能体规划模式提供借鉴。
大型语言模型稳定强化学习的新路径:几何平均策略优化GMPO
本文介绍了大型语言模型稳定强化学习新路径——几何平均策略优化GMPO。它是GRPO稳定化版本,通过优化几何平均替代算术平均,解决GRPO训练不稳定问题,在多任务实验中显著优于GRPO。
首个基因推理AI 横空出世!准确率飙至97%,彻底改变基因组学研究
多伦多大学等团队发布全球首个基因推理AI模型BioReason,将DNA基础模型与大语言模型融合,准确率从88%提至97%,可解释基因组变异致病机制,有望上线Hugging Face,应用前景广。
Cloudflare 推出 Agent Tracing:支持截断限制,不同框架的 Payload 默认记录策略存在差异
Cloudflare推出Agent Tracing,可提供统一Dashboard查看已部署Agent会话。该功能在现有Workers Tracing基础上增加Agent级别的Span,有收费时间表。不同框架Payload默认记录策略有差异,Trace有截断限制。
一文全解析:AI 智能体 8 种常见的记忆(Memory)策略与技术实现
本文剖析8种常见AI记忆方案,如全量记忆、滑动窗口等,分析其原理、特点和适用场景,还给出模拟代码助理解。不同策略各有优劣,适用不同对话场景,能为项目评估、选择和实现Memory方案提供参考。
为何95%的AI项目注定失败?回到未来,策略型代理AI才是正确路径
《代理AI的进展:回到未来》指出,当前95%的AI项目失败因企业缺乏消费模型的架构。文章提出‘机器中的机器’理论,论证策略型代理AI是企业转型路径,还阐述构建算法化企业生态的方法。
这场巅峰对话,把China AI的基因、堵点和未来聊透了|甲子光年
2025年4月28日,甲子光年大会巅峰对话探讨‘China AI如何重塑全球AI价值坐标系’。大模型、算力、具身智能、芯片领域嘉宾各抒己见,谈China AI基因、应对策略、行业堵点及未来判断。
3.8K Star!港大开源 AI 量化神器:一句话生成量化策略,普通人也能玩懂!
港大开源的Vibe - Trading在投资圈火了,它是AI驱动的多智能体金融工作台,能将自然语言请求转化为交易策略等。有多智能体协作架构,内置64个金融技能、29个智能体团队预设,提供4种安装使用方式。