「长时稳定性」共找到 1301 篇相关文章
全流程国产GPU,上下文提速100倍!中国科学院发布「线性复杂度」类脑大模型
中国科学院自动化所李国齐、徐波团队发布国产自主可控类脑脉冲大模型SpikingBrain-1.0,训练推理全用国产GPU。它具线性复杂度,超长序列处理速度快,还开源7B模型,为类脑智能发展提供新思路。
多模态开发革命!Gabber开源:图形化构建实时AI应用,效率提升10倍!
AI应用迈向多模态交互,传统开发方式周期长。开源项目Gabber是实时AI应用引擎,通过模块化与图形化简化开发,有诸多特性,还给出安装指南,适用于多种场景。
深度解读《AI 智能体的上下文工程》:构建高效 Agent 的七个宝贵教训
作者解读 Manus 团队文章,结合自身理解总结出构建高效 Agent 的 7 个关键点,如依赖上下文工程、提升 Prompt 缓存命中率等,还给出总结与核心启示,对 Agent 开发有借鉴意义。
ICLR 2025新成果:文档检索“降本增效”,从此“开挂”
传统文档检索系统处理视觉信息丰富的文档存在瓶颈,ColPali方法直接从文档页面图像生成多向量嵌入,简化流程、提高性能、降低延迟。ColQwen - Omni在其架构上扩展到图文+音频多模态匹配。
编码器-解码器架构的复兴?谷歌一口气发布32个T5Gemma模型
谷歌在xAI吸引眼球时更新Gemma系列模型,发布多模态模型MedGemma,还一口气推出32个T5Gemma模型。该模型基于适应技术,性能表现佳,引发编码器 - 解码器架构复兴讨论。
模型压缩与量化:让大模型走向轻量化落地
文章介绍模型压缩与量化技术,其能在保持性能时降低大模型计算和存储需求,实现边缘设备高效部署。还阐述基础知识、关键技术路径、应用场景,并探讨未来发展方向。
OmniAvatar震撼开源!阿里夸克开源全新音频驱动角色模型
音频驱动人体动画技术有局限,阿里夸克团队推出OmniAvatar模型。它用逐像素多层次音频嵌入和LoRA训练法,解决唇动同步等问题,适用于多领域,但也存在颜色偏移等不足。
马斯克祸不单行!擎天柱负责人突然离职,特斯拉蒸发万亿市值
特斯拉创下单日最大跌幅,市值蒸发1500亿美元时,擎天柱Optimus项目负责人Milan Kovac宣布离职。他是特斯拉十年老将,离职因想多陪家人。现任AI软件副总裁Ashok Elluswamy将接替其工作。
Meta Shuffling的MoE Grouped GEMM kernel benchmark
作者拷贝fbgemm开源的moe grouped gemm kernel,修复小bug后与SGLang的Grouped GEMM Triton Kernel对比,结果显示fbgemm在MoE模型上性能提升显著,可应用到SGLang的ep - moe的grouped gemm kernel中。
类R1训练不再只看结果对错!港中文推出SophiaVL-R1模型
DeepSeek - R1爆火后,类R1结果奖励训练范式引发推理热潮,但仅以结果对错奖励模型有弊端。港中文联合团队发布多模态推理模型SophiaVL - R1,引入‘思考奖励’机制,还用Trust - GRPO算法解决奖励欺骗问题。