「国产开源LLM」共找到 4143 篇相关文章
1.7K Star 新晋神器!一款轻量、开箱即用的终端日志神器,AI 助力、实时可视化,效率飞升!
现在系统日志信息量大、噪声多,传统工具定位问题既慢又麻烦。而开源工具Gonzo基于Go语言开发,有实时日志流处理、交互式仪表盘等功能,安装简单,打破传统工具局限,节省时间。
The Batch: 882 | Qwen3-Next 提速
阿里巴巴对开源权重模型 Qwen3 全新升级,发布 Qwen3 - Next - 80B - A3B 的 Instruct 和 Thinking 版本权重。其融合新研究成果,推理能耗低、速度快,还优化架构和训练方法提升效率与稳定性。
AI Coding 的下半场,何去何从?
文章回顾AI Coding三年演进,指出2023年范式落地、2024年Coding Agent上位、2025年形态之争加速且CLI成主战场。分析项目“火爆”逻辑,提及市场数据背书,还探讨应用与模型关系及技术堆栈。
马斯克宣布用户将可语音定制X信息流
埃隆·马斯克宣布11月X平台算法将由AI驱动,开源代码会持续更新,用户能语音定制信息流。此计划引两极反应,算法也有缺陷,还面临可信度和信息茧房等问题。
告别「面瘫」配音,InfiniteTalk开启从口型同步到全身表达新范式
传统video dubbing技术有局限,新兴模型也有问题。美团视觉智能部研发的InfiniteTalk引入‘稀疏帧video dubbing’,实现口型、表情、肢体与音频自然对齐,解决长视频生成难题,技术已开源。
ICCV 2025 | 打造通用工具智能体的基石:北大提出ToolVQA数据集,引领多模态多步推理VQA新范式
北大团队提出ToolVQA数据集,用于提升基础模型工具使用能力。它含2.3万条样本,贴近真实需求。通过ToolEngine构建,涵盖多工具与任务领域。微调后模型表现佳,代码与模型已开源。
高性能计算群星闪耀时
文章介绍高性能计算(HPC)对大模型的重要性,回顾中国HPC发展历程,讲述清华高性能所郑纬民等学者贡献,还提及团队在大模型训练、推理、存储等方面成果,以及类脑计算等新探索。
奖励模型新革命!SWIFT不读文本读“心声”,打造又快又强又省钱的AI裁判
传统Best-of-N方法中的奖励模型成本高、速度慢,限制技术普及。上海交通大学等校研究者提出轻量级技术SWIFT,直接监听模型内部隐藏状态判断信心,效率、准确率等表现出色,为AI发展提供新范式。
大模型如何推理?斯坦福CS25重要一课,DeepMind首席科学家主讲
Google DeepMind首席科学家Denny Zhou在斯坦福CS25课程分享大语言模型推理见解,总结了四个关键点,阐述推理机制、优化方法及最新进展,还介绍多种推理方法并比较其优劣。
2025CSDI:大模型引领智能研发与IT组织变革
文章指出AI发展将推动私有知识价值增大,其应用成战略重点。如DeepSeek打破行业固有观念,引领变革。未来智能时代经济源于智能体,AI重构企业生产力,2025CSDI峰会将探讨相关场景应用。