精度与效率」共找到 7269 篇相关文章

算法论文8

VLM 实现 10%的精度提高,13.1倍加速!纽约大学新算法让视觉语言模型更小、更快、更准确

纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。

AIGC开放社区
开源动态8

《生化危机》女主演跨界AI拿SOTA了!打造免费“AI记忆系统”爆火GitHub

《生化危机》女主角Milla Jovovich程序员老友及Claude合作,打造开源免费的AI记忆系统MemPalace。该系统在多项测试中成绩优异,采用“记忆宫殿法”,检索效率提升34%,还设计了AAAK语言,成本低且精度高。

量子位
推荐文章7

DRAM技术发展综述:历史、技术路线图未来展望

本文深入分析DRAM技术,追溯其历史,探讨当前格局未来前景,比较其SRAM优劣,考察中国主要DRAM企业发展历程并国际同行对比,旨在提供对DRAM和SRAM生态系统的全面理解。

芯师爷
算法论文8

谷歌之后,英伟达入局扩散大语言模型,Fast-dLLM推理速度狂飙27.6倍

大语言模型领域,推理效率制约实际应用。谷歌Gemini diffusion曾展扩散模型并行潜力,但开源扩散LLM推理慢。近日,NVIDIA等推出Fast - dLLM,无需训练即插即用,推理速度狂飙27.6倍,兼顾速度精度

机器之心
算法论文8

具身智能发展趋势展望 | 中国工程科学

文章深入探讨具身智能的概念、内涵、计算框架系统实现,梳理发展现状、趋势挑战,强调生成式AI在其演进中的关键作用,还分析我国发展进展、风险,并给出研究方向对策。

力学与人工智能
产品应用8

AI 时代的 MySQL 数据库运维解决方案

文章指出大模型MySQL数据库运维结合能改变传统管理方式,提供完整的MySQL大模型运维系统构建路径,涵盖知识库建设、模型选择调用策略设计、MCP Server开发及监控优化闭环建立,可提升运维效率准确性。

阿里云开发者
新闻资讯7

理解生成统一多模态模型:现状未来 | 直播预约

从GPT - 4o到Gemini,AI实现跨模态联合理解生成,核心是统一多模态基础模型。但开源社区构建强大统一模型面临挑战。南大等团队梳理超750篇论文分析技术路线,将有直播探讨现状未来。

深度学习自然语言处理
算法论文8

综述 | Agentic RL for LLM的最新进展未来挑战,idea满满

该综述对新兴的Agentic RL进行系统性总结展望,介绍其传统LLM - RL区别,从核心能力和任务视角阐述其应用,梳理支撑系统,指出核心挑战未来方向,展示通向通用AI的希望之路。

深度学习自然语言处理
推荐文章7

金融智能体落地四阶段,同花顺Agent战略实践全景

在数字化 AI 驱动下,金融行业变革正酣。同花顺产品总监路忠文解析 AI Agent 在金融领域实践,结合案例揭示其突破传统业务边界的潜力,探讨落地挑战趋势,还分享了公司自身 AI 探索历程实践经验。

InfoQ
新闻资讯7

坪山芯链通!坪山区半导体集成电路公共服务平台联动发展活动圆满举办

4月28日,坪山区半导体集成电路公共服务平台联动发展活动举办。活动通过平台揭牌、演讲、参观等环节,搭建政企学研资协同平台。六大平台展示成果能力,活动打通平台企业沟通渠道,助力产业发展。

芯师爷