3D场景叙事系统」共找到 3512 篇相关文章

算法论文7

MoE RL 实战:统一 FP8 全流程训练

SGLang RL 团队等实现 RL 全流程 FP8 训练与采样,消除训推不一致性。介绍 FP8 硬件基础、格式等,分析训练难点,定位 KL Loss 异常源于量化原理,验证其在 MoE 模型 RL 场景优势,指出模型规模与训推不一致的关联。

GiantPandaLLM
开源动态8

sgl-kernel MoE Align Block Size Kernel 优化过程解析

文章记录SGLang的sgl-kernel中优化 `moe_align_kernel.cu` 的过程。MoE模型的 `moe_align_block_size` kernel从最初的baseline版本经多次迭代,包括加向量化padding、用Blelloch Scan并行化前缀和、用Warp Scan减少同步开销等。

GiantPandaLLM
新闻资讯7

Sora 2 惊现 LLM 推理能力,视频生成模型也能搞推理?

Sora 2在科学推理基准测试中获55%成绩,虽不敌GPT - 5,但一个视频生成模型能做推理令人惊讶。Epoch AI实验发现其可能借LLM重写提示词答题,网友也证实背后或有GPT - 4o等处理。此外,Google研究显示视频模型经大量训练或有推理能力。

AGI Hunt
推荐文章8

Thinking Machines又发高质量博客:力推LoRA,不输全量微调

Thinking Machines 博客力推 LoRA 并与全量微调对比。研究发现小数据量任务中 LoRA 与全量微调效果接近,大数据量稍吃力,强化学习中低秩 LoRA 也能接近全量微调。还揭示了 LoRA 关键要素、超参数规律等。

机器之心
新闻资讯7

又 3 个新 AI Coding 拿了融资,AI 找 Bug 也火了

AI Coding成今年增长最快应用领域,近期又有3个产品获融资。印度Emergent完成2300万美金A轮融资;Rocket.New获1500万美金种子轮融资,欲成综合Agent系统;Vibecode定位App领域,拿940万美金种子轮融资。此外,AI找Bug也火了。

投资实习所
开源动态8

6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0

蚂蚁百灵大模型团队开源 MoE 大模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找到新平衡,为大模型‘参数膨胀’提供新路径,还在多领域应用表现出色。

机器之心
推荐文章8

想成为一名合格的 AI PM,先抛弃过去那些让你成功的经验

文章指出 AI 产品经理与传统产品经理不同,AI 是会演进的系统。掌握 AI 产品策略是 PM 首要技能,从方向、差异化、设计、部署、领导力五阶段构建策略,还介绍了结构化实验方法,无策略的 PM 将被淘汰。

Founder Park
开源动态7

最强开源Agent!Kimi K2接入Claude Code,爽翻~【喂饭级教程+实测】

上周五Kimi开源最新旗舰模型K2,它是1000B参数MoE大模型,专为Agent场景优化,API已上线且兼容多API。文章给出Kimi - K2接入Claude Code的喂饭级教程及实测,实测显示组合表现有亮点也有不足。

开源星探
推荐文章7

垂直赛道 Agent 闷声发财指南:如何实现一年超千万营收?

本文围绕垂直赛道的2B Agent展开,分享了语核科技创始人的产品理念与经验,探讨了如何找到有价值的场景、构建高价值闭环。还介绍了客户的应用情况、对Agent的看法及选型考量,强调其商业价值与落地挑战。

Founder Park
新闻资讯7

Devin CEO:别搞多智能体!Anthropic:我们性能提升90%!

最近,开发Devin的Cognition CEO发文称不要构建多智能体系统,而Anthropic分享构建多智能体研究系统,性能提升90%。Cognition认为多智能体协同难,坚持单线程线性Agent;Anthropic用工程设计绕开瓶颈。二者因任务类型不同观点有别。

探索AGI