开源大模型」共找到 10076 篇相关文章

算法论文8

开源模型竟被用于窃取下游微调数据?清华团队揭秘开源微调范式新型隐藏安全风险

清华、墨尔本学团队研究指出,基于开源模型微调专有模型存在新型隐藏安全风险,开源模型发布者可埋后门窃取下游微调数据,新风险难检测、危害,目前攻防方法待改进。

机器之心
开源动态8

小米MiMo-V2-Flash开源:3090亿参数模型能否改写AI行业规则!

2025年12月16日小米开源旗舰模型MiMo - V2 - Flash,参数3090亿。它有独创‘按需激活’机制,推理成本低。采用MIT协议,价格亲民,构建全栈开源矩阵,在编程、长文本处理等领域表现出色。

MCP Server
开源动态8

告别模型“失忆”!人开源MemSifter:轻量代理先思考再回忆,搞定长时记忆

当前语言模型在长周期任务中,长时持久记忆管理陷入“精度不够”和“成本太高”的两难困境。中国人民学团队提出MemSifter框架,将记忆检索工作外包给轻量级代理模型,在8个权威测试中超越现有方案,且已开源

PaperAgent
开源动态8

10% KV Cache实现无损数学推理!这个开源方法解决推理模型「记忆过载」难题

推理模型推理时易现冗余问题,R-KV开源方法登场,显存降90%、吞吐提6.6倍、准确率达100%。它通过实时对token排序解决冗余,还经多步骤压缩KV缓存,性能测试表现出色,适用多场景。

量子位
开源动态8

× MBZUAI重磅开源!A₁:全透明高效 VLA 模型,机器人实时控制成本直降 76% 丨CVPR 2026 Findings

开放世界机器人操作被模型算力成本和推理延迟难题困住,中与MBZUAI团队推出全开源的A₁模型,其自适应推理方案降低推理延迟和骨干计算量,性能超主流基线,打破‘高性能=高成本’魔咒。

AI科技评论
算法论文8

华为中科联创模型低比特量化算法,1‰数据实现昇腾无损压缩7倍

华为诺亚方舟实验室联合中科提出CBQ后训练量化方案,仅用0.1%训练数据实现模型7倍压缩,保留99%精度。该成果登ICLR 2025 Spotlight,已加入昇腾ModelSlim工具包。

新智元
算法论文8

告别单一模型依赖!北航等机构发布综述:语言模型集成(LLM Ensemble)

北航等机构发布的论文系统性回顾了LLM Ensemble领域进展,介绍分类法、相关问题、方法、基准、应用和未来方向。LLM Ensemble指推理阶段综合利用多模型优势,现有推理前、中、后三集成范式。

PaperAgent
开源动态8

小米的首代机器人VLA模型来了!丝滑赛德芙,推理延迟仅80ms丨全面开源

具身机器人成科技新热点,家期待其释放生产力。小米首代具身VLA模型Xiaomi - Robotics - 0抓间歇停顿问题,4.7B参数规模下推理延迟仅80ms,还做三项技术创新,且全面开源

量子位
算法论文8

牛津VGG、港、上交发布ELIP:超越CLIP等,多模态图片检索的增强视觉语言模型预训练

牛津VGG、港、上交团队论文提出ELIP方法,用学术界资源增强视觉语言模型预训练,用于文字 - 图片检索。该论文被会接受并获最佳论文提名。ELIP可应用于多个模型,实验显示能显著提升图片检索表现。

机器之心
推荐文章7

特征工程、模型结构、AIGC——模型在推荐系统中的3落地方向|文末赠书

文章指出模型在三个层次改变推荐系统,一是改变“知识学习”方式,带来知识输入革命;二是改变“智能体”结构,探索推荐模型新范式;三是创造“新世界”,实现个性化内容生成。还介绍了相应落地应用及对从业者的建议。

AI前线