在离线混部」共找到 8255 篇相关文章

开源动态8

蚂蚁开源 x SGLang Meetup技术回放解读系列之面向DeepSeek系列模型的深度优化与实践

文章是对蚂蚁开源x SGLang Meetup中「蚂蚁Theta面向DeepSeek系列模型的深度优化和实践」分享的解读,详细介绍了H20-96G上对DeepSeek系列模型推理的优化方案,包括Prefill和Decode阶段的优化、通信优化、观测诊断等,并给出了评测结果。

GiantPandaLLM
新闻资讯7

Sora 2 惊现 LLM 推理能力,视频生成模型也能搞推理?

Sora 2科学推理基准测试中获55%成绩,虽不敌GPT - 5,但一个视频生成模型能做推理令人惊讶。Epoch AI实验发现其可能借LLM重写提示词答题,网友也证实背后或有GPT - 4o等处理。此外,Google研究显示视频模型经大量训练或有推理能力。

AGI Hunt
8

APP推广,常用的100种英文名称解释

ASO工具箱里装着哪些英文专业名词?从AARRR到watchOS,一篇文章带你了解APP推广中常遇到的100个英文术语。

算法论文8

李飞飞团队新作:简单调整生成顺序,大幅提升像素级图像生成质量

长期以来,AI生图面临潜空间模型细节损耗、像素空间模型结构乱速度慢的矛盾。李飞飞团队最新论文提出Latent Forcing方法,通过重排生成轨迹,让像素扩散模型找回效率并刷新SOTA。

量子位
新闻资讯7

2025上半年大模型使用量观察:Gemini系列占一半市场份额,DeepSeek V3用户留存极高

推特博主「karminski - 牙医」基于OpenRouter数据,分析2025年上半年大模型API市场,涵盖总Token使用量、市场份额、细分领域用量、API接口使用趋势等,得出各模型表现及市场格局的观察结论。

Founder Park
产品应用8

DeepSeek-V3.2-Exp:用稀疏注意力打破长文本效率瓶颈

NLP领域,处理长文本时传统注意力机制效率低。DeepSeek团队推出DeepSeek-V3.2-Exp模型,引入稀疏注意力机制,保持性能同时提高长文本处理效率,降低计算复杂度,多基准测试中表现良好。

CourseAI
算法论文8

夜间感知新突破!北航等提出红外主导的高效目标检测方案 | ECCV'26

复杂视觉场景中,传统RGB - IR多模态检测方法低照度等场景下因RGB退化影响检测效果。北航等团队提出的InfraNet,以红外为主,用质量感知机制控制RGB引导,多数据集取得强竞争力结果。

新智元
算法论文8

ICSE 2026杰出论文 | 突破代码模型真实工程落地瓶颈,北大团队提出SEAlign对齐框架:显著提升软件工程智能体决策质量

现有代码模型经典基准表现好,但真实软件工程环境表现差。北大金芝、李戈团队提出 SEAlign 框架,通过识别与对齐智能体轨迹关键决策点,提升模型真实工程任务表现,成果获 ICSE 2026 杰出论文奖。

机器之心
开源动态8

Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!

Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它单张H100 GPU训练6小时后,MMStar数据集准确率达35.3%,且能免费Google Colab跑。

AGI Hunt
开源动态8

港大开源ViMax火了,实现AI自编自导自演

香港大学黄超教授团队开源ViMax框架,GitHub获高星标。它借助多智能体协作实现AI自编自导自演视频,突破主流模型长视频制作的瓶颈,采用多种策略应对技术挑战,不过多方面仍有提升空间。

机器之心