LLM微调库」共找到 1420 篇相关文章

算法论文8

上海人工智能实验室让AI像科学家一样在探索中发明工具

上海人工智能实验室等团队提出推理时工具演化(TTE)框架,推动AI在科学领域从被动选工具到主动发明工具。它解决传统工具问题,提升多学科推理准确率,赋予AI跨学科迁移能力。

AIGC开放社区
开源动态8

狂涨26.5K star!一个接口搞定20+AI大模型,开箱即用,太香了!

文章介绍开源项目One API,它是LLM API管理与分发系统,能统一管理主流AI模型,用一个接口搞定调用。有友好界面和可视化操作,在Github获26.5K star,还介绍其性能特色、安装使用方法。

开源先锋
算法论文8

Discrete Tokenization:多模态大模型的关键基石,首个系统化综述发布

近年来,人们关注将LLM能力扩展至非文本模态,Discrete Tokenization成关键方案。但现有研究缺系统总结,香港科技大学等团队发布首个相关系统化综述,梳理技术脉络、方法及挑战,给出未来研究方向。

机器之心
开源动态8

一键秒懂GitHub仓,开发者必备!

面对陌生的GitHub项目,直接把代码扔给AI效果不佳。而`Gitingest`这款开源工具,能将Git仓转化为适合LLM处理的文本摘要,适配各类AI助手输入需求,使用方式灵活,在GitHub上很受欢迎。

开源先锋
新闻资讯7

Hugging Face CEO预警:AI泡沫将破,无人幸免!

过去一周,「AI泡沫论」密集爆发。Hugging Face的Clem称是「LLM泡沫」,非AI;谷歌皮查伊警告泡沫破裂无人幸免;资本已开始撤离。AI或经历如互联网般的过热与坍塌,落地技术才是未来。

新智元
产品应用7

刚刚,这家0产品0模型就估值854亿的公司,终于发布了首款产品!

Thinking Machines Lab推出首款产品「Tinker」,这是专为语言模型微调而生的API,让开发者摆脱底层架构束缚,用简单Python代码专注创新。它功能强大,目前免费私测,已获普林斯顿、斯坦福等团队使用。

新智元
算法论文7

智能体的致命三要素及六种安全设计模式

智能体发展带来诸多安全问题,仅靠外部防护不合理。Simon Willison总结其致命三要素,指出间接提示词注入攻击难防。Invariant Labs等提出六种安全设计模式,可综合使用,多LLM方法值得关注。

AI与安全
开源动态8

通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API

阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。

量子位
开源动态8

85倍速度碾压:苹果开源FastVLM,能在iphone直接运行的视觉语言模型

苹果开源能在 iPhone 上运行的视觉语言模型 FastVLM,代码仓含 iOS/macOS 演示应用。它速度快,首个 token 输出速度较同类模型提升 85 倍,还兼容主流 LLM,适合边缘设备等场景。

机器之心
开源动态8

VoxCPM2:无tokenizer语音合成,高保真声音克隆

VoxCPM2突破传统TTS系统局限,直接操作连续声学特征,保留音色纹理更完整。基于扩散自回归架构,有硬核技术指标,提供三种克隆模式,性能佳,生态完善,微调便捷,但也存在安全风险。

AI工程化