「分层策略结构」共找到 1485 篇相关文章
正确答案 ≠ 正确推理,CoT 或成大模型推理能力停滞的「罪魁祸首」?
研究指出当前大模型推理能力评估多关注答案准确性,忽视推理步骤。通过对前沿模型测试发现,2023 - 2024 年大模型推理能力提升停滞,进步靠提示工程,自底向上策略最有效。
仅需一行代码AI智商飙升成本反降!Claude推出军师模式:最强模型opus只做幕后大脑
Anthropic在Claude平台实装军师策略,让Opus模型后台当军师,轻量级模型当执行者。仅改一行代码就能实现,成本低且能提升智商,已开启Beta测试,还给出使用步骤。
智谱GLM-5强调的Agentic Engineering能力是什么?|甲子光年
智谱上线并开源GLM - 5,在Coding与Agent能力上达开源SOTA,刺激股价上涨。它验证了Agentic Engineering可行性,提升能力阈值,但成本阈值也更显性,未来软件工程或分层发展。
宇树:开源机器人世界大模型!
宇树开源世界模型 - 动作架构UnifoLM - WMA - 0,它属UnifoLM系列,适配多机器人本体。真机部署表现出色,预测与实际操作吻合。官方介绍训练策略,代码开源后GitHub获100 + Star。
企业官网GEO优化:可直接复制JSON-LD+llms.txt模板(适配AI推荐)
文章提供企业官网GEO优化方案,含首页、FAQ页结构化代码及llms.txt模板,还有通用FAQ选题。介绍使用方法、上线校验步骤和生效判断标准,助企业适配AI推荐。
比肩Claude Opus:阶跃星辰最强模型Step 3.5 Flash发布
阶跃星辰发布最强模型 Step 3.5 Flash,参数强大,性能与前沿顶级大模型并驾齐驱。其架构平衡算力与智力,有独特注意力布局;基础设施保障训练稳定;强化学习激发智能体潜能;评测数据显示战斗力强,未来还将持续优化。
准确率提升至 90%,阿里商旅基于 AgentScope 构建多智能体差旅助手最佳实践
阿里商旅依托阿里巴巴生态,旗下AliGo差旅助手可实现业务闭环。早期单智能体模式有瓶颈,后基于AgentScope构建多智能体系统,从技术选型、架构设计等多方面优化,事项收集准确率提至90%+,还解决诸多问题并获奖。
田渊栋离职Meta,最后一篇论文?
离职Meta后,田渊栋团队论文被NeurIPS 2025录用。研究提出「三门理论」,发现RLVR微调在小权重发力,不破坏模型结构,还绘制出RLVR训练动态的「参数层面全景图」。
Claude Code开源了代码简化Agent,千年“屎山”代码终于有救了!
Claude Code开源代码简化Agent,可在不改变程序行为下降低代码复杂度。它能自动简化结构、减少冗余,提高可读性。该功能可通过官方插件试用,网友认为其实用,还呼吁更多内部技能开源。
LLM省钱大测评!48块GH200,首个百亿级参数量实证
EfficientLLM项目聚焦LLM效率,提出三轴分类法和六大指标,实验覆盖多方面。研究表明效率优化需权衡,最优策略因任务和模型规模而异,且相关技术可迁移到跨模态模型,成果将开源。