「手机端推理」共找到 2610 篇相关文章
【博客翻译】使用PyTorch加速生成式AI第四部分:Seamless M4T,快速优化
这是使用纯原生PyTorch加速生成式AI模型系列博客的第四部分,专注加速FAIR的Seamless M4T - v2模型。通过torch.compile + CUDA Graph,在不损失精度下实现text decoder模块2倍、vocoder模块30倍加速,端到端推理2.7倍加速。
SD又回来了!一秒出图,手机就能玩:SD3.5-Flash让专业AI绘画进入“闪电”时代
Stability AI联合萨里大学SketchX实验室推出SD3.5-Flash模型,能在普通电脑甚至手机上快速生成专业级高分辨率图片。它将推理步骤压缩、显存要求降低、出图时间大幅缩短,画质也没明显缩水,还在性能上反超SD3.5M。
用75亿募投资金理财?摩尔线程:合理提高资金收益;豆包手机“可查询银行卡余额”?官方辟谣侵犯用户隐私;小扎宣告元宇宙死亡|Q资讯
本文汇总 AI 行业近期热点,有摩尔线程拟用 75 亿闲置募资理财,Meta 砍元宇宙投入转 AI,豆包手机回应隐私质疑,宇树推人形机器人应用商店等,还涉及阿里、腾讯等大厂动态及 IT 业界消息。
「百万级」视频推理数据集!30+顶尖高校联合发布
AI视频生成已能「画得像」,但不会「想得对」。VBVR推出百万级视频推理数据集,首次系统评测模型对空间、物理、逻辑和抽象的推理能力,发现顶尖模型通过率仅68%,推动视频AI从「视觉模仿」迈向「智能推理」。
Pixel 10『打样』AI手机:苹果、华为、三星差几年?
谷歌发布被称为“全球最AI的手机”Pixel 10系列,全新Tensor G5+端侧Gemini Nano带来AI领先。文章将其与苹果、华为、三星手机对比,分析各品牌AI功能优劣势,指出未来手机竞争是硬件、系统与大模型的综合较量。
ICLR 2026|UIUC:一行代码彻底解决LLM推理的过度思考!
2025年DeepSeek发布推理大模型,引发RLVR研究热潮,但该方法有“过度思考”问题。伊利诺伊大学香槟分校等研究者提出Self - Aligned Reward(SAR),能提升推理准确度和效率,有望推动大模型推理系统发展。
OpenAI自曝:AI推理砸钱越多,碾压人类越狠!
OpenAI研究员探讨推理模型时代。Noam Brown强调预训练和推理范式,指出当前AI胜在通用性。推理范式成本低、效果好,如o系列模型表现出色。首席经济学家谈AI经济影响,称其重塑企业格局。
我拿到了豆包 AI 手机,但它已被围剿
作者拿到豆包AI手机时,它已被部分产品禁止使用。此为面向行业和技术爱好者的技术预览版,内置AI Agent可像人一样操作手机,还介绍了功能、架构等,但推广因App墙受限。
DeepSeek推理最高提速6倍!开源研究:加装「思维进度条」,计算量减少30%
特拉维夫大学团队开发新方法,给LLM推理任务装进度条,控制推理深度和速度。提出“思维进度向量”TPV预测推理位置,干预TPV可“超频”“降频”,模型已在GitHub开源。
华为| 祭出FlashComm1,FlashComm2、FlashComm3,解决LLM推理通算瓶颈
在大模型推理面临通算难题背景下,华为数学家祭出FlashComm 1、2、3。如FlashComm 1优化AllReduce通信,提升推理性能;FlashComm 2重构计算流程,提升推理速度;FlashComm 3实现多流并行,激增模型吞吐。