推理效率」共找到 3033 篇相关文章

推荐文章8

提示工程实战指南:从Zero-Shot到Graph Prompting,7大核心技术全解析

随着大型语言模型发展,提示工程成关键技能。文章介绍零样本提示、少样本提示等七种提示优化模式,分析适用场景、优缺点,还给出示例,最后总结各技术适用场景及最佳实践。

OpenMMLab
产品应用8

不懂建模也能做角色!VAST升级AI神器,一手实测来了:一键拆建/魔法笔刷/万物绑骨

3D大模型明星初创公司VAST推出的Tripo Studio大升级,有智能部件分割、贴图魔法笔刷等四大核心功能,直击过去建模流程痛点,实现从“给模型”到“交成果”的质变,提升全链路效率

量子位
产品应用8

英伟达再破世界纪录,每秒1000 token!刚刚,全球最快Llama 4诞生

英伟达用Blackwell创下AI推理新纪录,单节点8颗GPU实现Llama 4 Maverick模型每秒单用户生成1000个token。这得益于技术组合拳,如用TensorRT - LLM优化、应用FP8格式等,满足了低延迟需求。

新智元
算法论文7

ACL2025 | 抓出0.1%的捣乱分子压缩方法OTT:近乎无损 超越KIVI,内存减6.4倍 吞吐量提2.3倍

LLM生成文本时KV Cache内存占用高,限制模型批量处理能力。论文提出OTT方法,动态追踪异常令牌单独高精度保存,其余压缩。实验显示,它准确性高、效率好,不过在极短文本等场景有局限。

深度学习自然语言处理
新闻资讯8

图灵奖得主杨立昆现场追问:AI 还没越过这 3 道认知墙,谈什么通用智能?

图灵奖得主杨立昆指出AI未越过三道认知墙,即看不懂物理世界、无长时记忆、无推理结构,提出JEPA架构及AMI概念,还建议别卷模型,应卷架构,如探索具身智能等领域。

力学与人工智能
开源动态8

字节Seed新方法!开源8B代码模型:自己筛数据训练自己,同量级SoTA,还能超越百亿级对手

传统code大模型依赖人工筛选数据,成本高、效率低。而Seed - Coder团队让LLM自己筛选数据训练自己,打造8B参数轻量级开源代码模型,性能超百亿级对手,不过也存在通用和数学能力短板。

深度学习自然语言处理
算法论文8

CVPR 2025 | 如何稳定且高效地生成个性化的多人图像?ID-Patch带来新解法

本文围绕个性化多人图像生成展开,指出其面临身份特征泄露等挑战。介绍了早期方法的不足,提出全新的ID-Patch方案,阐述其设计思路、实验效果等,还探讨了提升空间与未来方向,该方案在多人物图像生成中有突破式提升。

机器之心
推荐文章9

更聪明的AI就能随心所欲控制人类?OpenAI科学家笑了:你比猴子聪明,能让猴子听话吗?

本文是科技媒体The Information对OpenAI研究科学家Noam Brown的深度访谈,围绕AI Agent、推理模型、AI安全、OpenAI研发战略展开,披露了Hugging Face多Agent事件细节,分享了诸多反直觉的前沿技术观点,信息密度极高。

AI科技大本营
新闻资讯8

马斯克:AI巨浪已至,吸干全球救命钱!

马斯克警告AI激流已至,过去一年全球AI推理Token用量暴增25倍。ARK首席未来学家指出AI基础设施投资回报高,引发资本转移与挤出效应,传统企业融资难、人才流失,将被AI“吸干”资本。

新智元
产品应用7

Seedance 2.5 抽卡老废片?专业团队的 4 层控制法

Seedance 2.5上线后,单条画质好但成片易散架,废片率高。文章将官方提示词指南和一线分镜写法整合成四层控制框架,还给出30秒短剧分镜示例,助你定位问题、提高抽卡效率

AI Reading Hub