大模型推理」共找到 9496 篇相关文章

开源动态8

没想到,最Open的开源新模型,来自小红书

向来低调的小红书昨日开源首个自研模型 dots.llm1,它是中等规模的 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最,还介绍了数据处理、训练优化等多方面技术细节。

机器之心
算法论文7

开源中小模型+Skills也性能暴增!卢森堡学探索了小模型驾驭Skills的边界

卢森堡学等研究探索小模型驾驭Skills的边界。工业界因数据安全渴望开源小模型,智能体Skills框架让小模型性能暴增。研究拆解小模型处理复杂任务的方法,还验证不同策略有效性,发现代码专用模型优势。

AIGC开放社区
开源动态8

性能提升84%-166%!L-Zero仅靠强化学习解锁模型探索世界的能力 | 已开源

招商局狮子山人工智能实验室团队用RLVR让模型“自学”,构建L0系统,含NB - Agent框架和端到端强化学习训练流程,开源相关内容。测试显示L0显著提升模型性能,展现强泛化能力。

量子位
算法论文8

谷歌的DeepSeek时刻:LLM推理加速被干到了8倍

谷歌TurboQuant论文介绍量化算法,能为语言模型和向量搜索引擎规模压缩。可将语言模型KV缓存内存减至少6倍、加速达8倍且精度零损失,还介绍其工作原理及实验结果。

PaperAgent
新闻资讯8

性能比肩Gemini 3 Pro!昨晚,阿里千问最强模型来了

1月26日深夜,阿里千问旗舰推理模型Qwen3 - Max - Thinking上线,综合性能对标GPT - 5.2与Gemini 3 Pro。它突破传统推理方式,有自适应工具调用能力,助其在企业级AI竞争中领先。

机器之心
开源动态8

“边说边思考”,Mini-Omni-Reasoner 开创实时语音推理新范式

Mini - Omni - Reasoner将推理能力引入型语音模型,开创“边说边思考”范式,实现实时语音推理与交互。推出Spoken - Math - Problems - 3M数据集,经四阶段生成流程构建。训练采用分阶段策略,性能超基础模型

GitHubStore
开源动态8

手机也能跑,腾讯混元一口气开源4款小模型

腾讯混元团队开源4款小模型,最7B。可在低功耗场景运行,支持微调。是融合推理模型,有快、慢思考模式,在多领域表现出色,亮点是agent和长文能力,已落地多元业务场景。

机器之心
开源动态8

Hugging Face开源顶级模型:双模式推理+128K上下文,最强3B

今天凌晨,Hugging Face开源顶级小参数模型SmolLM3,参数30亿,性能超同类。它有128k上下文窗口,支持6种语言、双推理模式。架构细节等全开放,联合创始人强烈推荐,称是3B领域SOTA。

AIGC开放社区
开源动态7

超越ZIP的无损压缩来了!华盛顿学让模型成为无损文本压缩器

华盛顿学SyFI实验室提出LLMc,利用型语言模型进行无损文本压缩。基准测试显示其压缩率优于传统工具,且项目已开源。不过,当前版本存在效率、吞吐量等问题,应用范围也主要在自然语言。

量子位
开源动态8

首创TTFA指标!港团队开源FASTER,让VLA模型真正实现「即刻响应」

团队提出FASTER,重新审视动作分块策略的反应延迟问题,提出快速动作采样方法。它即插即用,已开源。通过Horizon - Aware Schedule等创新,降低TTFA、提高闭环频率,实验显示能显著提升VLA反应能力。

机器之心