自适应能力」共找到 4154 篇相关文章

算法论文8

142 TFLOPS 的差距:为什么在 Blackwell 上 FP4 MoE 算子工程至关重要

文章对三种主流MoE后端在Blackwell B200 GPU上做基准测试,发现SGLang与vLLM有142 TFLOPS差距,小batch时SGLang快1.84×。差异源于kernel融合、面向Blackwell的CUTLASS schedule及适应grid sizing等优化。

GiantPandaLLM
推荐文章7

后端架构新范式!阿里云专家亲揭:用RocketMQ彻底搞定多Agent异步协同难题

文章整理阿里云专家演讲,介绍基于 Apache RocketMQ 新特性构建异步化 Multi - Agent 系统,探讨 Agent 间异步通信等机制,指出 Multi - Agent 协同关键,还讲了 RocketMQ 新特性及如何构建异步系统。

AI科技大本营
开源动态7

SGLang Model Gateway 0.2 发布:企业级一体化AI原生编排

市面上一体化AI原生编排方案稀缺,Oracle和SGLang团队推出SGLang Model Gateway 0.2。它从SGL - Router重构而来,核心能力升级,架构分三层,部署灵活,还支持Kubernetes集成和向后兼容。

AI工程化
开源动态8

超越纯视觉模型!不改VLM标准架构,实现像素级深度预测

Meta开源DepthLM,首证视觉语言模型不改架构就能媲美纯视觉模型的3D理解能力。通过视觉提示等创新策略,它精准完成像素级深度估计等任务,为多领域带来前景。

新智元
开源动态7

从GPT-2到gpt-oss,深度详解OpenAI开放模型的进化之路

OpenAI 近日发布 gpt-oss-120b 和 gpt-oss-20b 两个开源模型,Sebastian Raschka 发布博客对其详细分析,回顾 GPT - 2 以来 AI 社区进步,还与 Qwen 3 比较,介绍架构、训练、推理等细节。

机器之心
新闻资讯7

这家国内公司,在给具身智能技术栈做「通解」

具身智能是AI热门赛道,世界人工智能大会WAIC 2025让其概念渐明。国内梅卡曼德公司展位集合机器人技术多种落地形式,展示研通用机器人「眼脑手」全栈技术产品,推动机器人各行业落地。

机器之心
开源动态8

Codex给V4-Flash装上眼睛,DeepSeek也会文档OCR

GitHub上的项目codex-vision-proxy让接进Codex的DeepSeek能看图,不用换模型或等官方,装本地代理即可。它还附带视觉工具包,在智能文档解析和OCR上潜力大,证明多模态能力可长在管道上。

CourseAI
新闻资讯7

太空算力排队到2030年,这家初创公司不等了:己造火箭把数据中心送上天

5月11日,太空基础设施Cowboy Space完成2.75亿美元B轮融资,估值达20亿美元。其创始人Baiju Bhatt计划造火箭,将上面级改造为在轨数据中心。但造火箭门槛高,轨道数据中心面临经济、延迟等难题。

DeepTech深科技
产品应用8

生数科技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务

生数科技认领神秘登顶模型MotuBrain,该模型4月中旬悄登两国际benchmark。它将预测与行动统一,具一脑多型等能力,技术上走边看边动路线,有响应快等优势。生数科技双轨布局,Vidu与MotuBrain同根。

量子位
推荐文章7

93%的人在用AI,为什么生产力只提升了10%——两个被严重低估的杠杆

Stack Overflow 2024年调查显示93%开发者用AI辅助工具,但DX Research研究表明生产力仅提升约10%。文章指出多数人用AI是线性叠加,真正的乘数效应来闭环验证和长期记忆,还分析误区并给出实践路径。

AI Reading Hub