开源小模型」共找到 9243 篇相关文章

开源动态8

DeepEval:LLM 应用评测不再玄学,让大模型评测像写单元测试一样简单

在大模型应用开发中,科学、自动化评测 LLM 输出质量是难题,人工评测效率低。DeepEval 是 Confident AI 团队开源的 LLM 评测框架,能用极简代码让评测像写 pytest 一样自然,内置多种评测指标,支持批量评测等。

AI工程化
新闻资讯7

Meta万引强化学习大佬跑路!用扎原话作为离别寄语,扎心了

Meta万引强化学习大佬Rishabh Agarwal即将离职,用扎原话“在这个瞬息万变的世界里,最大的风险就是不去冒险”作为离别寄语。他曾参与谷歌、Meta重要模型工作,下一站未明,Meta还有老员工出逃。

量子位
开源动态8

清华系团队出手!一张 4090 即可「爆改」,1.3B钢炮震撼开源

5月11日,清华系团队面壁智能联合多方开源端侧多模态大模型MiniCPM-V 4.6。它参数仅1.3B,性能超阿里、谷歌等同级对手,效率翻倍,还实现两项架构创新,适配主流开源生态,降低开发门槛。

新智元
算法论文8

音频大模型安全可信度的全面“体检”!6大维度,清华南洋理工联手打造

南洋理工和清华团队提出新框架AudioTrust,将ALLMs评估扩至六个核心维度,探究音频模态特有问题。目前基准及平台已开发,揭示了开源与闭源ALLMs在多维度的潜在风险。

量子位
开源动态8

SmolVLA: 让机器人更懂 “看听说做” 的轻量化解决方案

文章介绍轻量级开源视觉 - 语言 - 动作 (VLA) 模型 SmolVLA,专为机器人领域设计,可在消费级硬件运行。它用公开数据集训练,架构经优化,还引入异步推理堆栈,性能超部分大模型,降低研究门槛。

Hugging Face
8

现实版“盗梦空间”?欧洲极客论文全网爆火,一战戳破三大巨头安全神话,35万机密在公网裸奔

欧洲两位安全研究员的论文《从专有 LLM API 中窃取推理轨迹》爆火。他们揭示 OpenAI、Anthropic 和 Google 用的“无状态架构”有漏洞,能利用模型解码大模型推理轨迹,导致隐私泄露等风险。

AI科技大本营
新闻资讯8

黄仁勋CES放出大杀器:下一代Rubin架构推理成本降10倍

在CES 2026展上,英伟达黄仁勋介绍多项进展。下一代Rubin平台含六款芯片,推理成本降10倍;发布Alpamayo 1开源模型助力自动驾驶;还推出物理AI新模型等,携手伙伴展示机器人。

机器之心
新闻资讯7

这一年,DeepSeek消耗14万亿Token,编程仅占1/10,超一半用于角色扮演?

a16z和OpenRouter基于100万亿token研究揭示LLM使用情况:开源模型占三成市场,编程任务成刚需,角色扮演是金矿。还提到‘玻璃鞋效应’影响用户留存,市场分层为‘高端闭源+性价比开源’双轨制。

PaperAgent
算法论文8

Claude和GPT思维链竟被两步蒸馏!116页论文曝光API致命漏洞

2026年AI蒸馏成悬案,一篇116页论文砸穿巨头「黑盒」。研究人员用低价模型恢复Claude、GPT和Gemini原始推理,还发现API漏洞存在跨会话、用户和模型互通情况,收集公开轨迹泄露诸多敏感信息。

新智元
开源动态7

无需租GPU,一台24GB内存的笔记本就够了!

阿里开源稀疏 MoE 模型 Qwen3.6-35B-A3B,总参数 35B,激活 3B。它在智能体编程上超越前代,可与稠密模型媲美,支持多模态,已在 Qwen Studio 上线,还能集成第三方编程助手。

GitHubStore