参数压缩 - 覆盖假说」共找到 1208 篇相关文章

开源动态8

去掉 VAE 之后,商汤用 8B 参数重新定义了开源生图的上限

商汤SenseNova U1开源后引发开发者社区关注,它基于NEO - unify架构,摒弃VAE,实现多模态理解与生成原生统一。在多项基准测试中表现出色,还针对企业办公场景优化,成为生产级任务新选择。

AI科技评论
新闻资讯8

马斯克用恐怖算力,堆出6万亿参数性能怪兽Grok 5!剑指AGI

马斯克以Grok为核心推进xAI,从算力、数据到产品生态全面布局通往AGI的道路。Grok迭代迅速,有独特研发哲学。X平台数据、特斯拉算力成资源护城河,Grok还将进入特斯拉汽车。但Grok成长中也有争议,xAI在探索中前行。

新智元
算法论文8

0.01%参数定生死!苹果揭秘LLM「超级权重」,删掉就会胡说八道

苹果研究人员发现大模型中极少量的「超级权重」,即便占比仅0.01%,对模型能力影响巨大。这一发现为大模型「科学瘦身」提供思路,还提出定位方法,助力模型量化和未来研究。

新智元
产品应用8

不拼参数,拼认知:工业AI的边界与深水区 | 甲子光年

如今AI渗透工业各环节,形成“大小协同”格局,但面临场景复杂、数据孤岛等挑战。西门子凭借深厚积累构建工业体系,其Industrial Copilot等产品落地中国,还自研基础模型突破瓶颈,围绕‘AI for Real’理念布局。

甲子光年
产品应用8

把PLC仿真搬进浏览器,小参数模型也能实现高工程通过率

上海交通大学联合Sema研究团队推出SemaPLC,将AI Agent与PLC工程工具链连接,让自然语言需求转化为可编译、验证、仿真的控制程序。它是面向全流程的智能工作台,实验效果优于业界方案。

量子位
产品应用7

国民技术:覆盖机器人多模块,提供MCU+安全+蓝牙全栈芯片解决方案

国民技术是MCU及安全芯片领先企业,其N32H7/4系列MCU为荣耀“元气仔”、越疆Rover X1等机器人提供关键支撑,还广泛应用于工业机器人。此外,公司构建了MCU + 安全 + 无线射频的完整产品矩阵。

芯师爷
开源动态8

DeepSeek多模态新范式:一张图压缩7056倍,思考能力反超GPT和Claude

DeepSeek上线多模态并开源新范式技术。该研究让AI用视觉原语思考,弥合语言与视觉指代鸿沟。它构建紧凑模型架构,信息压缩率达7056倍,训练分三阶段,测试中表现出色,也存在局限。

AIGC开放社区
新闻资讯7

DeepSeek V4真要来了?万亿参数模型匿名开测,免费跑龙虾

推特博主曾‘预示’DeepSeek V4要来,后澄清不确定。今OpenRouter上新‘Hunter Alpha’和‘Healer Alpha’两神秘模型,免费且可跑‘龙虾’,社区对其归属猜测不断,答案待官方揭晓。

机器之心
产品应用8

参数破万亿!阿里Qwen3-Max-Thinking发布,编程能力“踢馆”Gemini与Claude

阿里发布总参数超万亿的Qwen3 - Max - Thinking,预训练数据规模达36T Tokens。在多项权威测试中表现优异,能与顶级闭源模型竞争。引入两项核心创新,千问App等已上新,网友认可其能力与更新速度。

AI前线
算法论文8

RAE+VAE? 预训练表征助力扩散模型Tokenizer,加速像素压缩到语义提取

近期,RAE 提出以「 冻结的预训练视觉表征」作潜空间提升扩散模型性能。同期西安交大与微软亚研院提出 VFM - VAE,结合 RAE 与 VAE,能加速模型收敛、提升生成质量,展示扩散模型 Tokenizer 演化方向。

机器之心