全量微调」共找到 2576 篇相关文章

推荐文章8

ChatGPT架构师,刚发布了最新研究成果

Thingking Machines发布第三篇研究博客,核心作者是OpenAI联创John Schulman。研究关于LoRA参数高效微调方法,探究其匹配全量微调效率的条件,给出简化调参方案,还提炼出三个核心发现。

量子位
新闻资讯8

Gemini 首次反超 ChatGPT,谷歌CEO劈柴哥复盘:不止是十年算力与栈豪赌,更是找回了“老谷歌”那个味儿

截至2025年底,Gemini在桌面和移动端单次使用平均停留时长首超ChatGPT,下载也快速追赶。谷歌将其嵌入自家生态策略见效,这与Gemini 3推出有关,还体现了栈能力与早期谷歌文化回流。

AI前线
新闻资讯8

开发者冲爆了!球前十AI Lab无限免费,一周烧出3.12万亿Token

6月1日,球模型榜单前十的Agnes AI无限期免费开放旗下核心模态模型API,引发开发者热情。两周后周调用达3.12万亿Token,本周还将升级,周五补齐语音模态链路,开源社区也围绕其开展诸多项目。

新智元
开源动态8

NVIDIA重磅开源!OmniVinci 仅 9B 模型就拿下多模态冠军!

英伟达推出模态大语言模型 OmniVinci,架构有三大创新。OmniVinci - 9B 模型表现亮眼,多测试中大幅超 Qwen2.5 - Omni,且训练仅为其六分之一。其架构经多阶段流程实现模态理解,还支持多种功能。

带你学AI
算法论文8

CVPR 2026 | ReFTA:打破张化PEFT的「权重重建」瓶颈

随着大模型发展,参数微调成本高,参数高效微调(PEFT)成主流。常见基于矩阵低秩分解的PEFT方法有局限,张化PEFT虽有优势但存在权重重建问题。本文提出ReFTA方法解决该问题,有工程和理论优势。

机器之心
开源动态8

TinyAI :栈式轻级 AI 框架

TinyAI是用Java实现的栈轻级AI框架,具有教育友好、模块化等特点。它分层设计,涵盖数学运算、神经网络等模块,支持多种模型架构与并行训练,还有智能体系统,可用于多领域,未来规划丰富。

阿里云开发者
算法论文8

图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效图建模方案

随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心
推荐文章7

网疯传的《OpenClaw橙皮书》更新了

《OpenClaw橙皮书》爆火,X浏览超180万,飞书文档2天访问超10万+。v1.1版本新增国产Claw产品选购指南、安事件及OpenClaw新功能。文档用Claude Code创作,有大人工环节。

花叔
算法论文7

Thinking Machines曝LoRA终极指南:10倍学习率,媲美微调

Thinking Machines推出论文《LoRA Without Regret》,研究LoRA与FullFT达到相近表现的条件。通过实验发现,把握关键细节,LoRA可与FullFT性能相当,还探讨了关键因素、批大小效应等内容。

新智元
产品应用7

又好用的 RAW 图片编辑器

RapidRAW 是轻的 RAW 图像编辑器,适用于多系统,为偏爱简洁流程的摄影师打造。它有 GPU 加速等特性,提供三种 AI 使用方式,有免费与付费选项,还介绍使用方法和系统要求。

GitHubStore