参数效率」共找到 1819 篇相关文章

算法论文8

NVIDIA港大MIT联合推出Fast-dLLM v2:端到端吞吐量提升2.5倍

自回归大语言模型推理效率受限,Fast - dLLM v2 由 NVIDIA、港大、MIT 联合推出。它将预训练 AR 模型适配为能并行解码的 Block - dLLM,用约 1B tokens 微调,端到端吞吐量最高提升 2.5 倍,精度相当。

机器之心
开源动态8

快慢思考不用二选一!华为开源7B模型实现自由切,精度不变思维链减近50%

华为发布openPangu-Embedded-7B-v1.1,参数7B却有双重“思维引擎”。采用渐进式微调策略和快慢思考自适应模式,可自由切换快慢思考,在多评测中精度提升,思维链减近50%。还推出openPangu-Embedded-1B小模型。

量子位
新闻资讯8

万物皆可AI的时代?Arm发布全球首个Armv9边缘AI计算平台

Arm发布全球首个Armv9边缘AI计算平台,核心是Cortex - A320 CPU和Ethos - U85 NPU,能让小设备本地运行超10亿参数AI模型。边缘AI市场增长快,Arm转型切入,平台软硬结合优势明显,还有豪华朋友圈支持。

AIGC开放社区
开源动态7

烧了2000美金后,我发现Vibe Coding“已死”!

作者黄叔分享科研成果Spec Coding,称Vibe Coding已死,因其Prompt易逝、迭代混乱。Spec Coding复杂度高于提示词工程,文中给出从0到1及迭代的提示词和步骤,还提及额外好处及理念特性。

AI产品黄叔
算法论文8

CVPR 2025 Award Candidate | 英伟达等Difix3D+:用单步扩散模型修复 3D 重建伪影

3D重建领域中,NeRF和3DGS在新视角生成时易出现伪影,影响应用。英伟达团队提出Difix3D+,将预训练2D扩散模型用于3D渲染,单步去伪影,效率高、有泛化力,实验效果领先。

机器之心
开源动态8

小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 的四分之一

6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B的四分之一,在多个测评中表现出色。

AI前线
推荐文章8

GPT-4o图像生成的「核燃料」找到了!万字长文拆解潜在变量,网友:原来AI在另一个维度作画

上月,GPT - 4o图像生成功能爆火。Sander Dielman在博客中探讨生成模型利用潜在空间提高效率和质量,将潜在变量比作「数据精髓」,深入对比多种模型,还介绍训练方法、损失函数等,兼具理论深度与直观洞察。

机器之心
开源动态8

终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成

过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。

量子位
产品应用7

给 AI 一张陶罐碎片图,它能还原破裂过程吗?Minimax H3 vs Seedance 2.0 Fast 实测

文章实测 MiniMax H3 和 Seedance 2.0 Fast,给模型一张破碎陶罐图,让其生成破碎过程视频。分析 H3 技术逻辑,对比两模型效率、质感和物理细节等差异,指出开放与闭源模型的特点及视频模型待解决的问题。

AI科技评论
新闻资讯7

AI折叠!Fable 5和GPT-5.6,正沦为少数人的特权

当前AI体验出现严重“阶层折叠”,极少数人用Fable、GPT - 5.6等顶级大模型,大众用的是低参数的平庸产品。算力成本让普通人难以触及顶级AI,在医疗等领域也存在使用差距,不过也有人认为普通工作无需顶级模型。

新智元