含模量」共找到 1089 篇相关文章

开源动态8

斩获5.4K star!发现一款轻快速开源利器,支持插件和主题,非常6!

开源君介绍轻级文本编辑器`Lite XL`,它用 Lua 编写,基于「lite」优化,安装包仅几 MB,能在多系统流畅运行。其性能出色,还支持插件和主题定制,适合资源有限设备。

开源先锋
产品应用8

杀疯了!单卡4090跑通全微调,面壁1B级多态性能怪兽硬刚大厂

面壁智能推出MiniCPM-V 4.6,参数约1B,性能和推理效率出色。它在多态任务综合能力、推理速度上领先竞品,靠ViT架构改造和4倍/16倍混合视觉Token压缩实现创新,有工业验证,对开发者和普通用户意义大。

AI寒武纪
开源动态8

告别大型“失忆”!人大开源MemSifter:轻代理先思考再回忆,搞定长时记忆

当前大语言型在长周期任务中,长时持久记忆管理陷入“精度不够”和“成本太高”的两难困境。中国人民大学团队提出MemSifter框架,将记忆检索工作外包给轻级代理型,在8个权威测试中超越现有方案,且已开源。

PaperAgent
开源动态8

装机超2000万、全球主流GPU与AI框架“开箱即用”!OpenCloudOS成AI时代优先选项

在大型训练迭代快、算力需求高但 GPU 利用率低、生态碎片化的背景下,2025 OpenCloudOS 操作系统生态大会举办。OpenCloudOS 围绕 AI 升级技术,构建能力闭环,还发布智能基座,降低产业链技术摩擦。

InfoQ
算法论文8

NVIDIA港大MIT联合推出Fast-dLLM v2:端到端吞吐提升2.5倍

自回归大语言型推理效率受限,Fast - dLLM v2 由 NVIDIA、港大、MIT 联合推出。它将预训练 AR 型适配为能并行解码的 Block - dLLM,用约 1B tokens 微调,端到端吞吐最高提升 2.5 倍,精度相当。

机器之心
算法论文8

0.01%参数就能接近全微调!低数据微调极致省参方案来了 | ACL'26

瑞典隆德大学与Google DeepMind团队研究大型微调省参方案。发现低数据场景下,微调Value投影中的b(v)比b(q)或b(k)性能更好。该研究已被ACL 2026接收,集成进Hugging Face - PEFT库。

量子位
新闻资讯7

4·18 北京 Elastic AI Tech Day|搜索基座型议程( Jina 型与 Reader)

Jina AI 型迭代加速,Jina Embeddings 到五代目,Reranker v3获最佳论文。4月18日 Elastic AI Tech Day 将举办,Jina 团队将做系统公开技术分享,涵盖搜索AI等多方面内容。

Jina AI
开源动态8

4.5K Star 超极简!挖到一款更轻的“纳米级 OpenClaw”,8 分钟直接理解源码!

作者挖到更极简的OpenClaw复刻项目NanoClaw,开源3天获4.5K Star。它基于Claude Agent SDK构建,抛弃臃肿设计,拥抱“定制即代码”理念。功能特性丰富,安全型升级,核心仓库极简能力可无限扩展。

开源星探
算法论文8

清华联手英伟达打造扩散型新蒸馏范式!视频生成提速50倍,4步出片不穿

清华大学朱军教授团队与NVIDIA Deep Imagination研究组联合提出分数正则化连续时间一致性型(rCM),将连续时间一致性蒸馏扩展至大型,解决现有方法瓶颈,提升推理速度兼顾质与多样性。

量子位
推荐文章8

一文带你彻底搞懂!企业级MCP Server接入OAuth授权服务器全流程解析(完整代码)

文章从基础概念入手,借Python + MCP SDK + 第三方授权示例,解析企业级MCP Server接入OAuth授权服务器全流程,包OAuth 2.0概念、MCP支持架构、Google OAuth2.0认证实战及与其他安全方案配合。

AI大模型应用实践