本地大模型」共找到 9270 篇相关文章

算法论文8

十二顶尖模型决战华尔街与量化投资

文章解读重磅论文,该研究汇聚五家顶级AI厂商十二个模型,在标普500指数十一板块构建投资组合并测试。结果表明,混合智能策略是稳健收益最佳路径,未来量化投资是人机和量化模型三元融合。

AIGC开放社区
开源动态7

开源模型实战:GPT-OSS本地部署与全面测评

2025年8月5日,OpenAI发布GPT-OSS-120B和GPT-OSS-20B开放轻量级语言模型,采用Apache 2.0开源许可证。文章介绍通过Ollama本地部署GPT-OSS -20B模型的方法,并对其进行AI幻觉、算法、SQL、数学题等测试。

机器学习AI算法工程
算法论文8

TRM思考奖励模型上线,模型推理质量终于能量化了 | ICML‘26 Oral

模型推理评测多只看答案,忽略推理过程。上海多校团队提出TRM,用ME² principle刻画推理质量,DAG-based pairwise evaluation还原结构,训练奖励模型,让推理质量可度量、训练和优化。

量子位
开源动态8

攻克模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0

9月19日,蚂蚁百灵模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型性能,降低推理成本。

机器之心
算法论文8

提示词压缩竟成模型新漏洞?港科提出黑盒攻击框架COMA | ASE 2026

香港科技学研究发现,模型的“提示词压缩”模块会重写系统安全边界,成为新攻击面。团队提出“对抗性信息损失”概念和COMA攻击框架,实验有效,还给出隔离压缩防御方案。

机器之心
新闻资讯7

Karpathy:模型交互的第三种范式来了?这是不是夸其词

Anthropic 上线 Claude Tag,可让团队在 Slack 与 Claude 协作,能完成写 PR、数据分析等任务,有多人协作、积累上下文等特点。Karpathy 认为这是模型 UI 第三次改,但评论区有质疑,不过有咖背书或成‘数字员工’。

AI工程化
开源动态8

超越O4-mini,多模态模型终于学会回头「看」:中科院自动化所提出GThinker模型

现有多模态模型在通用场景推理有瓶颈,缺乏对视觉线索校验与再思考能力。中科院自动化所提出GThinker模型,有创新的「线索引导式反思」模式,经两阶段训练,性能超O4 - mini,论文等已开源。

机器之心
开源动态8

AI 本地跑?Google 新开源模型上线,本地量化后占用不到 200MB 内存,支持百余语言

Google DeepMind推出开源嵌入模型EmbeddingGemma,专为本地设备高效运行设计。它用Matryoshka方法和量化感知训练,提升效率。在MTEB测试中成绩佳,支持百余种语言,内存占用少,已集成多种工具。

InfoQ
新闻资讯7

印度国家级模型上线两天仅 300 余次下载,投资人直呼“尴尬”:韩国学生模型都有20万!

印度 Sarvam AI 发布国家级模型 Sarvam - M,虽被赞为本土 AI 研究突破,支持 10 种印度本地语言,但上线两天仅 334 次下载,投资人批评其成果‘令人尴尬’,引发社区激烈争论。

InfoQ
开源动态8

英伟达新架构引爆全模态模型革命,9B模型开源下载即破万

英伟达推出全模态模型OmniVinci并开源,其90亿参数规模性能超同级别甚至更高级别模型,训练数据效率是对手6倍,能精准解析视频和音频,在多模态应用场景中表现卓越,下载量破万。

新智元