低秩适应」共找到 1112 篇相关文章

算法论文8

VLM 实现 10%的精度提高,13.1倍加速!纽约大学新算法让视觉语言模型更小、更快、更准确

纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计分配策略,引入量化方案,经多模型评估,展现出硬件成本、高精度优势。

AIGC开放社区
产品应用7

00后下场整顿Agent:啥都不学就能用好AI,这才是正确打开方式

AI圈模型变强但使用门槛变高,00后团队打造的胖鹅AI以提示词为卖点,实测在生成视频、数据看板网页等方面表现出色。其核心是SOP体系,让AI适应人的习惯,降使用门槛。

量子位
推荐文章8

Thinking Machines又发高质量博客:力推LoRA,不输全量微调

Thinking Machines 博客力推 LoRA 并与全量微调对比。研究发现小数据量任务中 LoRA 与全量微调效果接近,大数据量稍吃力,强化学习中 LoRA 也能接近全量微调。还揭示了 LoRA 关键要素、超参数规律等。

机器之心
开源动态7

Pogocache:开源缓存软件实现延迟并支持多传输协议

全新开源缓存软件 Pogocache 近日发布 1.0 正式版,主打延迟与 CPU 高效能特性,支持多种主流通信协议,宣称比其他开源缓存方案有更高吞吐量和更延迟。还介绍了其架构、应用场景等。

InfoQ
开源动态7

独立开发者必看,前端人想做代码?先把这个 5k star 可视化拖拽编辑器 Demo 跑起来

`visual-drag-demo`是开源可视化拖拽编辑器Demo,偏前端与代码方向。它把编辑器必备功能做成教学项目,适合想做搭建器、可视化配置等的人快速摸清实现方法,功能丰富,学习成本

小华同学ai
产品应用7

刚刚,全网最猛AI视频模型免费了!我们手搓了一段「牛来」,效果绝了

AI短剧火爆,但创作者面临成本高痛点。Agnes Video 2.5系列模型上线Pavo平台,成本效果好,其Flash版免费。Pavo还有「无限画布」和「Agent创作模式」,降返工成本,实现门槛创作。

新智元
产品应用8

Qwen3-Embedding 全揭秘:从技术到服务,打造高效AI产品的关键路径

文章全面揭秘 Qwen3-Embedding,介绍其核心原理、优势、应用场景。还给出在 PAI 和百炼平台的使用方法,含部署、推理、微调等。通过对比实验,凸显其延迟、成本特点,未来将成语义理解核心设施。

阿里云开发者
开源动态7

免费开源成本的3D动作捕捉系统

FreeMoCap是无标记点3D动作捕捉系统,用普通USB摄像头就能实现研究级全身动作捕捉,支持单/多相机模式,输出3D骨骼数据,可导入Blender等工具,具有成本、开源可扩展等优势。

GitHubStore
推荐文章8

吴恩达来信:AI 速度带来的价值被估了

吴恩达指出,AI 不仅能降任务执行成本,还能显著加快执行速度,其在创造商业价值方面的重要性常被估。以编写代码、借贷审批等为例,说明提速能带来新价值,企业应关注可提速环节带动增长。

DeeplearningAI
新闻资讯8

OpenAI和Anthropic罕见互评模型:Claude幻觉明显要

OpenAI和Anthropic罕见合作,互相授予API权限评估模型安全与对齐情况并发布报告。双方派出多模型参与,从指令层次、越狱、幻觉、欺骗策略等方面评测,呈现各模型优缺点。

量子位