「低秩适应」共找到 1112 篇相关文章
VLM 实现 10%的精度提高,13.1倍加速!纽约大学新算法让视觉语言模型更小、更快、更准确
纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。
00后下场整顿Agent:啥都不学就能用好AI,这才是正确打开方式
AI圈模型变强但使用门槛变高,00后团队打造的胖鹅AI以低提示词为卖点,实测在生成视频、数据看板网页等方面表现出色。其核心是SOP体系,让AI适应人的习惯,降低使用门槛。
Thinking Machines又发高质量博客:力推LoRA,不输全量微调
Thinking Machines 博客力推 LoRA 并与全量微调对比。研究发现小数据量任务中 LoRA 与全量微调效果接近,大数据量稍吃力,强化学习中低秩 LoRA 也能接近全量微调。还揭示了 LoRA 关键要素、超参数规律等。
Pogocache:开源缓存软件实现低延迟并支持多传输协议
全新开源缓存软件 Pogocache 近日发布 1.0 正式版,主打低延迟与 CPU 高效能特性,支持多种主流通信协议,宣称比其他开源缓存方案有更高吞吐量和更低延迟。还介绍了其架构、应用场景等。
独立开发者必看,前端人想做低代码?先把这个 5k star 可视化拖拽编辑器 Demo 跑起来
`visual-drag-demo`是开源可视化拖拽编辑器Demo,偏前端与低代码方向。它把编辑器必备功能做成教学项目,适合想做搭建器、可视化配置等的人快速摸清实现方法,功能丰富,学习成本低。
刚刚,全网最猛AI视频模型免费了!我们手搓了一段「牛来」,效果绝了
AI短剧火爆,但创作者面临成本高痛点。Agnes Video 2.5系列模型上线Pavo平台,成本低效果好,其Flash版免费。Pavo还有「无限画布」和「Agent创作模式」,降低返工成本,实现低门槛创作。
Qwen3-Embedding 全揭秘:从技术到服务,打造高效AI产品的关键路径
文章全面揭秘 Qwen3-Embedding,介绍其核心原理、优势、应用场景。还给出在 PAI 和百炼平台的使用方法,含部署、推理、微调等。通过对比实验,凸显其低延迟、低成本特点,未来将成语义理解核心设施。
免费开源低成本的3D动作捕捉系统
FreeMoCap是无标记点3D动作捕捉系统,用普通USB摄像头就能实现研究级全身动作捕捉,支持单/多相机模式,输出3D骨骼数据,可导入Blender等工具,具有低成本、开源可扩展等优势。
吴恩达来信:AI 速度带来的价值被低估了
吴恩达指出,AI 不仅能降低任务执行成本,还能显著加快执行速度,其在创造商业价值方面的重要性常被低估。以编写代码、借贷审批等为例,说明提速能带来新价值,企业应关注可提速环节带动增长。
OpenAI和Anthropic罕见互评模型:Claude幻觉明显要低
OpenAI和Anthropic罕见合作,互相授予API权限评估模型安全与对齐情况并发布报告。双方派出多模型参与,从指令层次、越狱、幻觉、欺骗策略等方面评测,呈现各模型优缺点。