LLM微调库」共找到 1420 篇相关文章

产品应用7

Cloudflare 发布 Dynamic Workers 公开测试版:基于 Isolates 的沙箱环境执行 AI 智能体代码

Cloudflare 推出 Dynamic Worker 公开测试版,面向付费用户。它用 V8 Isolates 运行代码,启动快、内存效率高,基于 Code Mode 理念,用 TypeScript 接口定义 API,有多种防护策略,还发布配套,已用于生产。

AI前线
产品应用7

赛博鸡生蛋,7小时用Claude Vibe Coding一个Mini-Claude

本文是小白向文章,用Vibe Coding方式参考Claude实现精简版Mini-Claude。介绍开发流程,含打通LLM API调用、完成tool use调用等步骤,还提及后续待做事项及对AI开发的思考。

阿里云开发者
产品应用7

Harness Monitor:当多个 Agent 同时写代码时,如何看住质量

作者在有了 OpenAI 赞助的 Codex Pro 后,让多个 Agent 同时在一个代码工作。他开发的 Harness Monitor 从 Git 视角出发,解决多 Agent 写代码时的质量问题,涉及观察、治理等多方面能力。

phodal
算法论文8

2026开年关键词:Self-Distillation,大模型真正走向「持续学习」

2026年刚开场,Self - Distillation成大模型领域高频词汇。传统强教师依赖范式难适配大模型持续进化,MIT等顶尖机构发布三项成果,用不同方法实现自蒸馏,推动模型持续学习。

机器之心
产品应用8

首个大规模记忆湖发布,AI Infra跑步进入“记忆”时代

LLM是AI的“第一大脑”,记忆平台是“第二大脑”。当前AI企业应用进入生产力时代,竞争聚焦“隐性知识”记忆化。质变科技发布MemoryLake,具备多方面能力,在性能上优势显著,已服务众多用户和企业。

量子位
新闻资讯8

Bengio 15 年前论文再夺 AAAI 奖!AI 正告别单纯炫技,走向真实世界

全球人工智能顶会AAAI揭晓年度奖项,Yoshua Bengio 2011年论文获经典论文奖。今年5篇杰出论文研究方向指向AI从炫技走向应用,如ReconVLA改进VLA视觉感知,CADYT解决连续时间因果结构学习空白等。

InfoQ
算法论文8

跳出「黑盒」,人大刘勇团队最新大语言模型理论与机理综述

大语言模型工程成功但理论研究滞后,被视为「黑盒」。人大刘勇团队用生命周期分类法,将LLM理论研究整合为六阶段,系统综述底层理论与机制,指出前沿挑战,为其向严谨科学转型提供路线图。

机器之心
开源动态8

Transformers v5 中的分词系统:更简洁、更清晰、更模块化

文章聚焦 Transformers v5 分词系统,介绍分词概念、流程、主流算法,对比 transformers 和 tokenizers 。着重讲 v5 改进,如架构与词表分离,解决 v4 黑盒问题,还能从零训练专属分词器。

Hugging Face
产品应用8

9.1K Star!这个工具把 Claude Code 的幸福感拉满了,终于不用手撸 JSON 配置了!

Claude Code等让开发者回归终端开发,但配置“反人类”。GitHub上的cc-switch工具基于Rust + Tauri开发,支持多款模型快速配置切换,有可视化面板及多种功能,还集成Skills,大大提升使用体验。

开源星探
新闻资讯8

仅4人28天!OpenAI首曝Sora内幕:85%代码竟由AI完成

OpenAI团队揭秘安卓版Sora APP构建内幕,4人团队28天完成从0搭建,约85%代码由AI智能体Codex完成。Codex可自我迭代,在多方面表现出色,但也需人类指导。团队分享了与Codex协作的经验和技巧。

新智元