「超级权重」共找到 507 篇相关文章
OpenAI成立10周年!Sam Altman 发文:未来10年一定可以实现超级智能
OpenAI成立十周年,Sam Altman发文回顾点滴与突破。从不确定起点出发,团队克服困难,取得多项成果,推出ChatGPT等。他认为未来一年会有更多成果,再过十年几乎肯定能实现超级智能。
一家新能源大厂,如何撑起全球最大AI算力超级单体?
8月6日,远景科技集团在乌兰察布宣布「远景乌兰察布星河基地」投产,全球最大AI算力超级单体亮相。随着算力扩张,电力从配套成核心,远景将新能源转化成稳定算力能源,交付可承载大规模算力的基础设施。
DeepSeek-GRPO重要性权重设计错误?详解Qwen3新强化学习算法GSPO
论文指出GRPO在大语言模型训练中不稳定,因其重要性权重设计错误易引入高方差噪声。为此提出GSPO算法,从序列维度计算梯度,解决了MoE模型RL训练的稳定性问题,在Qwen3上效率更高。
聚焦手机AI“超级入口”,中兴Nebula小模型让手机秒变“小秘”?
移动智能时代,手机AI“超级入口”成竞争焦点。美团率先推出AI Agent,中兴通讯自研Nebula-GUI模型表现亮眼,在测评中获佳绩,已在多款手机商用,还开发数据制备系统,经监督微调、双层强化学习提升性能。
清华校友赵晟佳,出任Meta超级智能首席科学家!GPT-4核心功臣,和LeCun平起平坐
Meta宣布清华校友赵晟佳担任超级智能实验室首席科学家。他是ChatGPT、GPT - 4等模型核心贡献者。Meta为组团队不遗余力,还准备超大规模算力,与OpenAI等的AI竞争白热化。
曾拒15亿美金,超级天才Andrew Tulloch重返Meta,Thinking Machines Lab痛失联创
扎克伯格今年挖角动作不断,此前向Thinking Machines Lab开高价被拒,主角Andrew Tulloch曾拒绝超10亿美元报价。如今他离职将重返Meta,其加入能否为Meta超级智能注入新动力,值得期待。
刚刚,阿里Qwen3.6又悄悄放出4个开源权重,卷疯了
继今年2月发布Qwen3.5系列后,阿里推出Qwen3.6多个开源权重版本。Qwen3.6优先保障稳定性与真实场景可用性,为开发者提供更好编码体验。介绍了Qwen3.6 - 27B和Qwen3.6 - 35B - A3B亮点。
Meta 新成立超级智能实验室,让大模型RAG推理速度飙升30倍
Meta新成立超级智能实验室(MSL),首篇论文REFRAG将RAG推理速度提升30倍以上。它先把上下文压缩成摘要再解码,减少计算量和延迟,在多任务测试中表现出色,为大模型部署提供实用方案。
冷战核废墟变8吉瓦AI超级工厂!黄仁勋押15亿,OpenAI独霸20年
英伟达、OpenAI和软银要将美国俄亥俄州冷战核废墟改造成全球最大AI超级工厂,终极电力规划达8吉瓦。黄仁勋宣布注资、担保,OpenAI签长约,孙正义改造电网,这或成稳赚买卖。
大模型如何"不训练"也能学习?——上下文学习的隐式权重更新机制
大型语言模型能通过上下文学习(ICL)在推理时即时学习新任务,无需修改模型参数。本文首次证明自注意力层与MLP层组合能隐式将上下文信息转为MLP层低秩权重更新,解释了ICL原理,为构建AI系统开辟新路径。