小参数量模型」共找到 8210 篇相关文章

开源动态7

极客说|Unsloth 的全微调之路:从 Adapter 到 Full Fine-tuning

大语言模型参数多,微调难。Unsloth 原靠支持 Adapter 微调出名,现支持全参数微调,单卡就能搞定大规模模型训练。文章介绍其进化历程、关键技术、工程部署、使用优势及最佳实践。

AIGC开放社区
8

现实版“盗梦空间”?欧洲极客论文全网爆火,一战戳破三大巨头安全神话,35万机密在公网裸奔

欧洲两位安全研究员的论文《从专有 LLM API 中窃取推理轨迹》爆火。他们揭示 OpenAI、Anthropic 和 Google 用的“无状态架构”有漏洞,能利用模型解码大模型推理轨迹,导致隐私泄露等风险。

AI科技大本营
算法论文8

Claude和GPT思维链竟被两步蒸馏!116页论文曝光API致命漏洞

2026年AI蒸馏成悬案,一篇116页论文砸穿巨头「黑盒」。研究人员用低价模型恢复Claude、GPT和Gemini原始推理,还发现API漏洞存在跨会话、用户和模型互通情况,收集公开轨迹泄露诸多敏感信息。

新智元
算法论文8

NIPS2025|红书智创AIGC团队提出布局控制生成新算法InstanceAssemble

当下文本生成图像扩散模型有进展,但现有布局到图像生成方法在复杂场景表现不佳。红书智创AIGC团队提出InstanceAssemble框架,从架构和评测应对难题,实现复杂布局下精确图像生成,有广阔应用潜力。

机器之心
开源动态8

红书最新开源TTS力作!4人对话自然无缝,毫秒极速响应!

近年来TTS技术爆发,但多人对话的自然流畅性和长序列稳定性一直是难点。红书团队开源的FireRedTTS - 2是面向多人对话场景的TTS模型,实现自然切换和低延迟,支持多语言,适用于多种场景。

开源星探
新闻资讯7

Redis 之父:哪怕被喷我也得说,AI 远远落后于人类程序员!开发者跟评:用大模型气得我自己写代码都有劲儿了

Redis之父Antirez分享开发经历称人类程序员仍比大模型出色,举例说明在解决Redis复杂bug时,人类的创造力能想出奇特有效的解法,而大模型较难做到。开发者看法不一,有将其当助手,也有认为它会干扰思路。

InfoQ
开源动态7

性能碾压GPT-4.1-mini!Mistral开源Devstral,还能在笔记本上跑

法国AI初创公司Mistral与All Hands AI合作,发布全新开源语言模型Devstral,有240亿参数,所需算力低,可本地部署。它能解决真实GitHub问题,在SWE基准测试中表现优于多个模型,还能通过API访问。

机器之心
新闻资讯7

“iFold”,苹果AI新成果

苹果发布基于流匹配的蛋白质折叠模型SimpleFold,被戏称“iFold”。它用通用Transformer模块搭配流匹配生成范式,3B参数版本追平谷歌AlphaFold2性能,还解决了传统模型算力依赖问题,效率高。

量子位
新闻资讯7

吴恩达来信:为什么 Meta 会向 AI 工程师支付 1 亿美元薪酬

近期,Meta 因向 AI 模型开发人员提供超 1 亿美元巨额薪酬登上头条。模型扩展资本密集,薪酬占比,且 AI 对 Meta 业务机遇与威胁并存,招聘还能获技术洞察,所以高薪合理。

DeeplearningAI
8

Loop世界模型论文登顶Hugging Face,来自中国一家初创,周鸿祎陆奇都投了

Prompt还没退场,Loop已开始接管AI叙事。Loop Engineering突然爆火,而Looped World Models(循环世界模型)技术含金量更高,其论文登上Hugging Face Papers当日Top1。该论文由中国初创公司脸谱心智完成,成果显著。

量子位