本地大模型」共找到 9270 篇相关文章

新闻资讯7

养虾人狂吃国产模型!4.19万亿Token调用量激增34.9%超越美国

根据OpenRouter数据,上周中国模型周调用总量飙升至4.19万亿Token,再度超越美国登顶全球。中国产品在全球模型调用量Top 5中占三席,国产模型受青睐,但在速度和价格方面仍待提升。

量子位
算法论文8

人格向量:模型性格的数学解码与精准操控

语言模型在应用中会出现危险行为偏移与训练引发的非预期偏移,传统方法难监控干预。本文发现人格特质在线性方向表现为“角色向量”,实现提前预测、实时监控和主动控制,为AI安全提供数学框架。

深度学习自然语言处理
8

模型狂叠 buff、Agent乱战,2025洗牌预警:96%中国机器人公司恐活不过明年,哪个行业真正被AI改造了?

InfoQ编辑部发布《2025年度盘点与趋势洞察》,探讨模型、Agent等领域变化,分析行业被AI改造情况。指出2025年格局重塑,竞争焦点转变,国内AI有进展但与硅谷有差距,还介绍了模型、Agent、AI Native等发展趋势。

InfoQ
算法论文7

AI集体“听不懂”!MMAR基准测试揭示音频模型短板

MMAR基准测试对30款音频相关模型进行测试,结果显示,多数开源模型面对复杂音频推理任务远未达实用水平,音乐任务中所有模型表现不佳,且有显式推理能力的模型表现更优。

量子位
算法论文8

模型哪里出问题、怎么修,这篇可解释性综述一次讲清

来自多机构的研究团队发布“可实践的机制可解释性”综述,通过 'Locate, Steer, and Improve' 三阶段范式,为模型的对齐、能力增强和效率提升提供方法论,还梳理可解释对象体系和干预手段。

机器之心
算法论文8

AI失忆术!只需3个注意力头,就能让模型忘记「狗会叫」

Meta和纽约学团队发布论文《From Concepts to Components》,提出SAMD和SAMI方法。前者定位模型概念注意力模块,后者微调强度。能让模型‘失忆’,还可增强推理、控制安全,为AI研究开新方向。

新智元
开源动态8

本地运行、支持视觉与工具调用:Meta 开源智能体模型

Meta AI Research 推出 300 亿参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可证。它专为本地工作流设计,能在消费级硬件运行,经多项优化,在基准评估中表现出色,还支持多种框架。

AI前线
算法论文8

用更一致的轨迹、更少的解码步数「驯服」掩码扩散语言模型,扩散语言模型的推理性能和效率幅提升

扩散语言模型发展迅猛,或成下一代语言模型基础范式有力竞争者。复旦学等团队发布论文,提出高效解码策略与强化学习训练组合,解决MDLM解码和训练问题,提升推理性能与效率。

机器之心
产品应用7

Cursor发布首个编程模型!代码生成250tokens/秒,强化学习+MoE架构

Cursor 2.0正式发布,搭载自研模型Composer。它30秒完成复杂任务,比同行快400%,每秒生成250个tokens。还带来原生浏览器工具等新功能,基于强化学习,但模型底子透明度遭质疑。

量子位
产品应用7

隐私优先的本地匿名化小模型:在数据离开设备前保护个人信息

最强 AI 模型在云端,安全数据在本地,这一矛盾困扰着想用 AI 处理敏感信息的人。Freysa 团队提出解法,不重写提示,只替换敏感信息,用小模型实现精准匿名化,有实用价值。

AI工程化