调度机制」共找到 1012 篇相关文章

开源动态8

训练即服务!让模型训练回归算法语义,150行代码跑通RL

ModelScope团队开源Twinkle框架,采用Client - Server架构,支持20余种算法组件。开发者约150行代码就能编排复杂RL训练循环,底层调度等交给框架。它兼顾易用性与灵活性,有多种特点和优势,代码已开源。

量子位
产品应用8

国产模型编程能力卷到这个程度了?MiniMax-M2.5 深度实测

文章深度实测MiniMax-M2.5编程能力,用其开发多款游戏和点名工具,结果出色。还分析其底层技术,如原生Agent RL框架、过程奖励机制等,指出它性价比高,虽有不足但值得关注。

AI产品黄叔
新闻资讯8

这个春节,AI 不聊天了,开始替我买单

马年春节,腾讯、百度、字节跳动等大厂打响「AI 春节大战」。阿里旗下千问 APP 投入 30 亿启动「春节请客计划」,活动首日成绩显赫,还展示了跨应用调度等能力,探索出独特的「超级 Agent」路线。

机器之心
算法论文8

AAAI 2026杰出论文奖 | ReconVLA:具身智能研究首次获得AI顶级会议最佳论文奖

具身智能常被视为‘系统工程驱动’研究方向,ReconVLA获AAAI杰出论文奖,是具身智能方向首次获AI顶级会议最佳论文。它解决VLA模型关键瓶颈,通过重建式隐式视觉定位机制,实验效果显著。

机器之心
开源动态7

从组件到 OS 的跃迁,MemOS 深度拆解:构建企业级 Agent 的高性能记忆底座【上】

本文深入剖析开源记忆方案MemOS,它将记忆从“外挂组件”升为“系统资源”。介绍其设计理念、核心架构,分析记忆需加工、分层调度和治理的原因,还阐述记忆三态及流转,最后展示MemOS Cloud的使用方法。

AI大模型应用实践
推荐文章7

基于一个MXFP8量化Kernel谈一谈如何在B200上实现高性能的Memory Bound Kernel

作者向SGLang社区提交基于CUTLASS的MXFP8 Blockscaled Grouped GEMM实现,其中包含量化Kernel。文章关注此Kernel,介绍在B200上实现高性能Memory Bound Kernel的优化技术,如整体设计、向量化与合并访问、Occupancy优化、TMA利用等。

GiantPandaLLM
算法论文8

挖掘注意力中的运动线索:无需训练,解锁4D场景重建能力

香港科技大学(广州)与地平线团队提出VGGT4D,通过分析VGGT内部机制,利用注意力层运动线索,提出无需训练框架,在动态物体分割等任务表现优异,为低成本4D重建提供新思路。

量子位
产品应用7

我如何用低代码平台复刻NotebookLM体验:从文档到可控PPT生成,全流程实战。

本文作者用低代码平台BISHENG复刻NotebookLM的PPT生成功能。介绍了技术栈,详述工作流搭建,包括文档上传、问答、PPT生成等,还提及HITL机制提升成功率,最后总结了低代码平台的优势与不足。

AI大模型应用实践
开源动态8

DeepSeek 模型技术之旅:从 V3 到 V3.2

本文深入剖析了 DeepSeek 模型从 V3 到 V3.2 的技术演进,对比了基座与推理模型,介绍了架构、训练方法变化,如 V3.2 结合 MLA 与 DSA,更新奖励和 GRPO 算法,还提及 V3.2-Speciale 扩展思考特性。

深度学习自然语言处理
新闻资讯8

Anthropic内部揭秘20万代码交互记录背后的职业变迁

Anthropic官方发布内部实录,通过对132名工程师调查及20万条交互日志分析,揭示软件工程正从编写代码向管理代码演变。工程师AI使用率提升,工作方式、角色、信任机制等都发生了变化,也带来新挑战。

AIGC开放社区