「计算不可约性」共找到 1078 篇相关文章
GLM-4.7-Flash无审查版发布:30B MoE模型,仅3B激活参数
GLM-4.7-Flash无审查版由HauhauCS发布,基于原版移除审查机制。采用30B - A3B混合专家架构,总参数量31B,每次前向传播仅激活约3B参数,推理快,支持200K上下文长度,有两种变体和四种量化版本。
智算浪潮下的专有云操作系统安全:范式跃迁与信任链重塑
云计算发展使专有云成企业平衡便利与安全之选,但 AI 冲击其安全范式。阿里云三位专家探讨 AI 时代专有云安全,涉及物理隔离价值、新技术重塑安全逻辑、国产 OS 与芯片协同挑战等,还介绍阿里云方案及未来趋势。
AI竞赛下半场:为什么说“超级工厂”是最优解?
2025年夏天,巨头们因Agent的崛起对AI热情高涨,砸钱堆算力的背后是算力供不应求的困境。云计算因其具备极致的规模化、先进的生产工艺、柔性生产、智能管理和生态链接能力,被认为是AI的“超级工厂”。阿里云作为实例,展示了其完整的AI生产体系。
谷歌最强大模型付费上线,在DeepSeek开源后被吐槽太贵
谷歌最强模型Gemini 3 Deep Think上线,推理能力强,能将草图变3D场景、搭建游戏。它在多评测基准表现出色,准确率超GPT - 5 Pro等。但仅向Ultra会员开放,月费约1800元,被吐槽贵,开源的DeepSeek-V3.2成冲击因素。
ACM MM 2025 | 小红书AIGC团队提出风格迁移加速算法STD
小红书AIGC团队提出风格迁移加速算法STD。现有一致性模型在风格化任务有缺陷,文章提出从部分噪声状态出发的训练框架STD,设计轨迹状态库减轻计算负担,引入非对称对抗损失增强风格一致性,实验显示其效果优。
无需NeRF/高斯点后处理,视频秒变游戏模型成现实!新方法平均每帧仅需60秒 | ICCV 2025
KAUST团队提出全新方法V2M4,能从单目视频直接生成高质量、显式的4D网格动画资源。该方法构建多阶段流程,涵盖相机轨迹恢复等关键步骤,平均每帧约60秒,比现有方法显著提速,论文已被ICCV 2025接收。
小扎「梦之队」首批论文上线!LLM自举进化,单步性能狂飙22%
Meta超级实验室MSL新论文探索用强化学习微调大语言模型。提出探索迭代(ExIt)法,基于RL自动课程学习,训练仅需单步任务,模型学会多步自我改进。在MLE - bench上,ExIt相对GRPO提升约22%。
西游取经团再出征:小米 Token Plan 能把 Token 价格打下来吗?
4月3日小米发布首款“走字儿”Token Plan计费方案,以Credit换算Token,不同模型换算比例不同,取消使用时间限制。实测MiMo V2 Pro完成任务水平在线,成本约为Lite套餐60%,但Token消耗难预估,其价值取决于任务场景。
谈一谈TP推理场景下MoE Group GEMM的优化思路
作者在使用H20测试SGLang CUTLASS MoE时,发现其在中小Batch Size场景下性能不佳。为此设计Expert Specialization方案,启动多个不同配置Kernel,依Expert计算特性选合适的。还介绍了该方案在H20和Hx00上的实现细节及性能测试结果。
6.1B激活,三榜开源第一!蚂蚁·安诊儿医疗大模型发布
由浙江省卫生健康信息中心等联合研发的开源医疗语言模型AntAngelMed发布。它基于Ling - flash - 2.0,100B总参数仅激活6.1B达约40B密集模型性能,在多个权威医疗基准测评中居前列,采用三阶段训练流程,高效MoE架构。