GPT架构」共找到 2741 篇相关文章

新闻资讯8

腾讯调整大模型组织架构:姚顺雨加盟,向总裁刘炽平汇报

腾讯宣布大模型组织架构调整,姚顺雨加盟。他是大模型Agent方向青年研究者,将任“CEO/总裁办公室”首席AI科学家等职。腾讯强化研发体系,混元大模型成果多,AI产品有竞争力,内部推进AI变革。

量子位
新闻资讯7

陶哲轩盖章!GPT-5.2杀疯了,我们终将沦为「硅基帕鲁」

币圈玩家Neel Somani用GPT - 5.2 Pro攻克数学难题,陶哲轩盖章确认。但此成功背后是极低的通过率,靠Aristotle工具筛选。人类数学家或转向定义问题,数学美感可能丧失。

新智元
新闻资讯7

OpenAI突然封锁最强GPT-5.4!3000个致命Bug瞬间蒸发

OpenAI在Claude Mythos泄露一周后,祭出专门为安全防御微调的GPT-5.4-Cyber,仅网络安全专家可用。还升级网络安全“信赖访问计划”。其战略有三原则,Codex Security已修好超3000个高危和致命漏洞。

新智元
算法论文7

GPT-6要「活」了?MIT新作曝光,AI「自进化」不远了

麻省理工学院推出全新自适应大模型框架「SEAL」,让模型从「被动学习者」变为「主动进化者」。网友猜测GPT - 6可能整合其能力,成为能自主学习的模型,研究虽有局限,但为大模型自进化提供新路径。

新智元
新闻资讯8

Mamba一作预告新架构!长文论述Transformer≠最终解法

Mamba一作将演讲整合成科普长文,探讨SSMs和Transformer模型权衡之术。认为Attention非万能,Transformer是阶段性最优。几天后将发布新架构,能与Transformers兼容,还回顾了两模型特点及结合优势。

量子位
产品应用8

微软深夜发布SambaY架构,Phi-4min加速10倍推理

微软基于Phi-4-mini版本,针对特定推理任务微调出Phi-4-mini-Flash-Reasoning 3B模型,将其扩展到200064 tokens。采用新型SambaY架构,支持64K token上下文长度,运行快10倍,有诸多优点。

PaperAgent
开源动态8

音频全能王炸!小米MiMo-Audio开源,力压Gemini/GPT-4o!

小米团队开源通用音频大模型MiMo-Audio,集多种功能于一身,支持7国语言零样本克隆和中英混合合成。首包延迟低,效果自然稳定。在多个基准测试中表现优于Gemini-2.5-Flash和GPT-4o-Audio。

开源星探
开源动态8

开源音视频同步SOTA基座:极简的单流架构,2秒出片

AI视频生成迈入音视频同步新纪元,闭源巨头已展实力,而上海创智学院与Sand.ai联合发布的开源音视频生成基础模型daVinci - MagiHuman,以极简单流架构,2秒就能在1张H100显卡上生成精准音视频同步画面。

AIGC开放社区
新闻资讯7

退钱!Claude 4.8连夜大降智,GPT-5.6算力遭「腰斩」

最近AI社区遭遇集体降智潮,OpenAI疑似暗中开启GPT - 5.6灰度测试,克扣用户思考预算;Anthropic的Claude Opus 4.8被曝断崖式降智,性能不如旧版。或因SpaceX上市抽干流动性,巨头降本增效。

新智元
开源动态8

万亿参数狂欢!一文刷爆2025年七大顶流大模型架构

文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。

新智元