「MEM1框架」共找到 3218 篇相关文章
配置一改就要重启的时代结束了:Dev Proxy 2.1 正式上线
Dev Proxy团队发布2.1版本,围绕开发效率和本地测试体验更新,有配置热重载、stdio流量代理等新功能,还改进配置、性能及细节问题。Dev Proxy Toolkit 1.12同步发布。
图解Vllm V1系列5:调度器策略(Scheduler)
本文是图解Vllm V1系列5,聚焦调度器策略。先回顾vllm v1整体运作流程,接着阐述调度 - 推理的整体流程,包括将请求添加进Scheduler、Scheduler单步调度策略等,还对比了不同场景下的函数及调度逻辑。
超越DeepSeek-R1,数学形式化准确率飙升至84% | 字节&南大开源
字节跳动Seed团队与南京大学联合发布CriticLean框架,将数学自然语言到Lean 4代码的形式化准确率从38%提升至84%。该框架创新性地将评估模型置于核心,解决语义对齐等问题,还构建了相关基准测试和数据集。
腾讯开源框架 Kuikly 再升级!率先适配 “液态玻璃”,原生体验更极致
腾讯开源框架Kuikly再升级,在苹果发布iOS 26系统背景下,新增“液态玻璃”适配。文章分析了“液态玻璃”给跨端框架带来的挑战,对比不同架构路线适配情况,还介绍了Kuikly的适配经验。
Claude最强Fable 5.1发布!8项屠榜,最高降价45%,反蒸馏机制上线
Anthropic发布Fable 5.1和Mythos 5.1,8项基准测试夺冠,价格最高降45%。展示科研成果,如蛋白质设计、生成金星地图等。上线反蒸馏机制,防止篡改上下文,还给出替代方案。
ECCV 2026 | 北大团队提出 Atomic Dance:基于原子动作的可解释音乐舞蹈生成框架
北大团队提出 Atomic Dance 框架,以原子动作作为舞蹈基本单元,建立有明确语义和结构的舞蹈表示,设计“动作规划 — 舞蹈生成”两阶段框架,让生成的舞蹈更符合音乐节奏和编舞逻辑,具备可解释性和可编辑性。
Claude Opus 4.1代码实测惊人!OpenAI开源模型却只会写屎山?
昨日,OpenAI、谷歌和Anthropic等发布新模型。Anthropic推出Claude Opus 4.1,虽性能提升不大,但编码能力获大客户认可。实测显示Claude - Opus - 4.1写代码稳,OpenAI新模型表现不佳。
测评豆包1.6:我用它开发了一个“聪明的旅行策划Agent”
作者对豆包1.6进行测评,用其构建旅行策划Agent。豆包1.6推理强、有自适应思考模式且计价创新。作者实操构建旅行Agent,结合MCP完成任务,虽有不足但超预期,国内Agent开发生态已成熟。
DeepSeek开源新基础模型,但不是V4,而是V3.1-Base
昨晚深度求索宣布DeepSeek线上模型版本升级至V3.1,在Hugging Face发布新模型DeepSeek - V3.1 - Base。该模型是V3系列最新基础模型,发布后冲上Hugging Face热门榜第4位,社交网络看法不一。
字节开源DreamO,一个框架包揽多种图像定制需求
近期图像定制研究展示大规模生成模型潜力,但多数方法通用性有限。字节提出DreamO框架,支持多种图像定制任务,有特征路由约束机制,能解决特征冲突,还介绍其技术原理与各任务效果。