国产开源LLM」共找到 4095 篇相关文章

开源动态7

开源项目的死与新生!

本文作者从自身经历出发,分享开源项目维护经验。指出开源目的影响项目寿命,开发者要选合适项目,避免重复造轮子。还阐述维护要点,如拥抱社区标准、有决断者、不怕改变、支持渐进迁移等。

腾讯技术工程
推荐文章7

AutoResearch-LLM:让 Agent 接手 LLM 训练优化

本文是 LLM 微调 AutoResearch 落地实战。作者将电商场景 Qwen3 微调流水线沉淀成 Agent 驱动的三阶段框架,还分享踩坑经验。思路方法与平台无关,可类比到外部环境,适合关注 AI Coding 等的同学。

阿里云开发者
推荐文章7

LLM学习笔记:最好的学习方法是带着问题去寻找答案

文章总结拓展Andrej Karpathy教学视频,分析大模型聊天流程与原理,介绍LLM训练步骤,包括预训练、后训练和强化学习,还提及主流特性应用,如文件上传、网络搜索,强调带问题学习的重要性。

腾讯技术工程
开源动态8

Anthropic祭出大模型“读脑”杀手锏:LLM决策过程全给你扒开看

Anthropic宣布开源电路追踪工具,可追踪LLM神经元,通过生成“归因图谱”揭示模型输出原因。开源了生成图谱的库和交互式前端,并提供demo notebook。可追踪电路、可视化图谱、检验假设。

AI寒武纪
开源动态8

国产AI拿下国际物理奥赛金牌,13项顶级竞赛豪取12金1银,划重点:开源

上海人工智能实验室团队推出开源模型家族P1,在IPhO 2025理论考试中,P1-235B-A22B成首个达金牌线的开源模型。引入PhysicsMinions后成绩提升,在HiPhO基准排名第一,且全链路开源

量子位
新闻资讯8

聊聊 Token 出海的生意经:模型开源给世界,中国赚什么?

本文围绕中国开源模型展开,介绍了 Cursor 使用 K2.5 模型事件,阐述了开源模型供应链,分析了中国开源模型受欢迎原因,探讨小公司技术机会,还提及开源面临的挑战及未来趋势,指出其正改变全球 AI 基础设施格局。

刘言飞语
开源动态8

国产GPU首获全球顶级推理框架「原生门票」:MUSA合入SGLang主线

近日,摩尔线程举办「SGLang × MUSA Meetup」,分享与 SGLang 社区及 MUSA 生态协同进展。其 MUSA 后端已加入 SGLang 官方支持体系,代码合入主线,还在多方面取得成果,众多开源项目核心维护者参与探讨国产 AI 算力。

机器之心
新闻资讯7

中国大模型如何破圈?开源不能太“独角戏”,也不是“上传 GitHub 就完事儿”

InfoQ 专访 Linux 基金会 Mark Collier,他分享对 AI 时代开源看法。指出开源是协作哲学,AI 开源与传统不同,倡导开放数据,认为商业限制不利生态,还谈及 Agent 与中国大模型开源等问题。

InfoQ
开源动态8

开源 x AI 的靠谱答案,都在这场嘉年华里了 | Q推荐

2025 Inclusion·外滩大会期间的开源嘉年华,用“上手体验 + 实战分享”回应开发者、创业者需求。创新舞台有精英分享,代码原生地可实操MCP工具,有童心趣工坊、互动展区等,助力开源生态发展。

InfoQ
推荐文章7

扩大 LLM 能实现 AGI吗?

计算机科学家Stuart Russell提出继续扩大现有大型语言模型(LLM)不会导致通用人工智能(AGI)的实现。文章探讨了LLM与AGI的关系,介绍了Russell的四大AI发展预言,还呈现了网友对AI发展、AGI定义等方面的热议,指出LLM是通往更高级AI的基石而非终点。

AGI Hunt