LLM微调库」共找到 1420 篇相关文章

推荐文章7

推荐两个Vibe Coding必备的skill,Vibe程序员效率起飞了

Vibe程序员应聚焦创意,提高效率很关键。文章推荐两个实用技能,一是codebase - to - course,助开发者理解代码;二是app - store - screenshots,可快速生成应用商店图,都经作者实测。

开源AI项目落地
开源动态7

推荐 4 个当下爆火的开源项目,Claude Code效率再翻倍

近期Claude Code相关开源爆火,作者推荐4个项目。badclaude解锁官方工具限制,gstack将AI变虚拟工程团队,claw - code作者机智保下,everything - claude - code优化AI编程体验。

开源AI项目落地
新闻资讯7

Helidon 引入 Agent 能力,Java 框架开始内建 AI 编排

Oracle 发布 Helidon 4.4.0 版本,对齐 OpenJDK 发布节奏,纳入 Java Verified Portfolio。引入新核心能力、Helidon JSON ,还增强与 LangChain4j 集成,支持智能体编排。

InfoQ
开源动态7

Kimi K2基于DeepSeek V3构建

从Hugging Face模型配置文件可知,月之暗面未设计全新模型结构,而是选Deepseek V3作基座模型,用自身高质量数据、独特方法做大量‘微调’和‘后训练’。

AI寒武纪
算法论文8

Agent 护城河:揭秘Harness的三大支柱

上海交大等机构研究者梳理LLM Agent设计逻辑,指出能力正从模型内部流向外部,外部化有记忆、技能、协议三大支柱,Harness负责协调,Agent竞争转向外部化基础设施。

CourseAI
开源动态7

8.8k星星!开源的211个专家级Agent,一键接入,一个人就是一个团队

今天推荐agency-agents-zh,它是agency-agents深度汉化版,有211个精选Agent,适配国内生态。需注意,skill并非越多越好,按需选择,避免浪费资源和输出无效结果。

开源AI项目落地
开源动态8

2小时入门「个性化联邦学习」,上交清华开源斩获1700+星 | JMLR'25

上海交通大学和清华大学研究人员开源个性化联邦学习代码PFLlib,含39种算法、3种场景和24个数据集,支持模拟500设备训练,还有隐私保护评估工具,降低研究门槛。

新智元
新闻资讯7

DeepSeek、GPT、Qwen,所有大模型架构图都有,Karpathy:宝藏画廊!

大模型赛道热闹,架构创新多,理解困难且缺清晰架构图。AI 研究者 Sebastian Raschka 绘制主流大模型结构,整理成在线图谱「LLM Architecture Gallery」,方便研究者查阅对比。

机器之心
新闻资讯7

GPT-5或马上现身,神秘Repo出现了其踪迹

OpenAI新推理模型在奥赛夺冠,有人猜测是即将发布的GPT - 5,Sam Altman部分印证,还曾有人在biosec基准发现其踪迹,但repo已不可见。

AI工程化
推荐文章8

Sebastian Raschka 新书《从头开始推理》抢先看,揭秘推理模型基础

著名AI技术博主Sebastian Raschka新书《Reasoning From Scratch》第一章介绍LLM中推理含义、训练阶段、模式匹配与逻辑推理区别,还讲述提升推理能力方法及从头构建推理模型的重要性等内容。

机器之心