双环策略优化」共找到 1967 篇相关文章

开源动态7

DeepSeek开源MoE新利器LPLB:基于线性规划,专攻训练动态负载不平衡

DeepSeek在GitHub开源LPLB,这是基于线性规划的并行负载均衡器,用于优化MoE模型专家并行工作负载分配。它通过动态重排序、副本构建等机制实现动态负载均衡,支持多种拓扑结构,但也存在成本估算等局限性。

AI寒武纪
开源动态8

本周 5 个火火火的Github开源项目,每个都很有说法!

本周介绍5个Github开源项目。ai - berkshire将投资大师方法论系统化;stremio - web聚合视频资源;archify能将大白话描述变成架构图;Maple - font是优化的编程字体;Netcatty整合SSH客户端等功能。

开源先锋
算法论文8

大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!

Qwen团队、清华和南洋理工研究打破传统认知,揭示‘对齐税’现象。提出Confident Decoding策略,在多架构和评测集实验中表现出色,开销低,挑战‘LLM最后一层最优’常识。

量子位
产品应用7

Cloudflare 通过左移安全实践扩展基础设施即代码

Cloudflare实施基础设施即代码和自动化策略执行,将安全验证前置,消除手动配置错误,在部署前捕捉安全违规。该方案以Terraform等为核心,还解决了采用难题、配置漂移等问题。

InfoQ
开源动态8

达尔文.skill正式发布,一个无限进化的skill系统!

作者受Karpathy的autoresearch启发,开发了达尔文.skill系统,可自动评估和优化skill。它有五条原则、八维度评分体系,能批量解决skill质量问题,与Anthropic官方工具互补,现已开源。

花叔
产品应用8

Claude Code 省 Token 指南:慎用 1M 上下文,不开新会话或者总是开新会话都不对

文章聚焦Claude Code省Token问题,分析配额消耗快的原因,介绍提示缓存机制,给出省钱策略、操作规则,还提及委派工作及澄清误解,强调让缓存多命中、上下文少装无关内容。

宝玉AI
开源动态8

1.8K Star!又挖到一款超酷的 Claude Cowork 开源平替,而且比 Cowork 更快更省!

Anthropic 发布 Claude 的 Cowork 能力后成热门,但高额费用和封闭策略让普通人却步。现推荐开源替代方案 OpenWork,它免费开源,速度快、省 Token,还引入安全隔离机制,功能丰富。

开源星探
新闻资讯7

Anthropic把Claude送去当店长,结果AI疯了~

周末,Anthropic开展“Project Vend”实验,让Claude 3.7 Sonnet在旧金山经营小卖部。实验为期一个月,AI老板Claudius业绩不佳,亏损严重,还出现“发疯”等不可预测行为。Anthropic会继续优化它。

探索AGI
算法论文8

“这个怎么组装?”一句无害的问题,如何让AI产生危险输出

Amazon团队发现全新威胁模型“视觉排他性”,提出MM - Plan框架,通过强化学习训练智能体自动发现攻击策略。实验显示其对Claude 4.5 Sonnet和GPT - 5攻击成功率可观,代码和数据集已开源。

深度学习自然语言处理
开源动态7

3.7k星星!爆火开源网站GEO检测工具,老外靠教别人玩这个工具赚麻了

今年315让GEO被更多人关注,虽GEO滥用不行,但正常宣传可用。推荐开源网站GEO审查工具geo - seo - claude,它能多维度检测网站,给出审计报告和优化方案,还具备报告生成等能力。

开源AI项目落地