「国产开源LLM」共找到 4129 篇相关文章
The Batch: 929 | Qwen3.5 超越更大模型,领跑视觉基准测试
阿里巴巴发布 Qwen3.5 系列,含 8 个开源权重的视觉 - 语言模型。其小模型表现超大体量 OpenAI 开源权重模型,在视觉任务中整体出色,部分在语言任务也有竞争力。虽团队有人员离职,但阿里承诺加大 AI 投入。
单Agent时代结束,AI们开始组团上班
月之暗面发布并开源K2.6,重点升级代码能力与多Agent协作的“Agent集群”能力。K2.6在Artificial Analysis上取得全球开源第一,实测能并行交付多格式成果,还展现出强大的全栈应用开发能力。
AI办公斩杀线,一页文档多少钱
腾讯混元Hy4 preview正式发布并开源,参数770B,是开源阵营里参数最大的Apache 2.0模型。它能处理长文本,官方定位有软件工程、办公分析等四个方向。还分析了处理一页文档的成本,指出办公AI下半场重在‘读懂’。
一大早被广告刷屏的"首个设计 Agent",居然是这家国内公司做的。
LovartAI凌晨发布引关注,网页前端漂亮。猜测其由国内Liblib公司开发,有三方面证据。它是设计Agent工具,功能较全,但对‘首个’存疑,其价值待观察。
推荐两个Vibe Coding必备的skill,Vibe程序员效率起飞了
Vibe程序员应聚焦创意,提高效率很关键。文章推荐两个实用技能,一是codebase - to - course,助开发者理解代码库;二是app - store - screenshots,可快速生成应用商店图,都经作者实测。
谷歌开源 Colab MCP Server,AI 智能体可云端运行代码
谷歌开源 Colab MCP Server,使 AI 智能体通过 MCP 与谷歌 Colab 交互,将本地智能体工作流与云端执行环境打通,解决本地部署局限,还反映 AI 智能体与外部工具交互标准化趋势。
NeurIPS2025 Spotlight | RobustMerge: 多模态大模型高效微调模型合并的全新范式
中科院、中山大学、北大团队针对高效微调模型合并难题,提出「方向鲁棒性」概念,揭示 PEFT 模块合并失败主因,给出 RobustMerge 解决方案,提升性能,成果开源。
Qwen开源版Banana来了!原生支持ControlNet
Qwen推出新图像编辑模型Qwen - Image - Edit - 2509,支持多图融合、增强单图一致性,原生支持ControlNet。还开源端到端全模态模型Qwen3 - omni,性能优异,功能丰富。
17K+ star!ElevenLabs 超强平替,能克隆、能混音、能 API 调用!
ElevenLabs 效果好但价格贵且有隐私风险,现开源项目 Voicebox 是其免费替代。它本地优先运行,功能丰富,如语音克隆、文本转语音等,在 GitHub 收获 17.4K+ Star,适合多类用户。
警惕!大模型成本倒挂:你正在为模型的多余「思考」买单
一项来自多所高校和微软研究院的研究揭示AI模型价格倒挂现象,低定价模型可能产生更高实际开销。研究聚焦8个前沿推理模型和9个主流数据集,指出推理token是成本倒挂主因,且实际开销难以预测。