扩散Transformer架构」共找到 2143 篇相关文章

产品应用8

动动嘴写SQL!Codex+终身记忆,OpenAI把查询难度直接归零

2026年初,OpenAI曝光数据分析智能体,将数据查询从「天数级」缩至「分钟级」。它用Codex驱动,有六层上下文架构,能补齐数据语义、沉淀经验记忆,让工程师提问取代手动查表。

新智元
算法论文8

2026 AI Memory最新综述:从理论到实战,一文读懂AI记忆的进化全景

2026年北邮百家AI MemoryOS团队联合华为发表《Survey on AI Memory》,涵盖AI记忆理论基础、分类体系、架构、评估方法与前沿趋势,还提出4W分类法,剖析了发展挑战与未来方向。

PaperAgent
新闻资讯8

AI教父Hinton首爆十年前拍卖:我早已内定谷歌必赢!

NeurIPS 2025访谈中,AI教父Hinton和Jeff Dean回顾AI发展。Hinton透露Scaling顿悟源于Ilya演讲,还谈及AlexNet、谷歌大脑诞生等。二人探讨Transformer、Gemini,也对AI未来发展方向发表看法。

新智元
新闻资讯8

Nature发布Delphi-2M模型,提前20年预测你得什么病

2025年9月17日《自然》发表研究成果,欧洲、德国和丹麦科学家改造GPT架构,推出Delphi - 2M模型。它能预测1258种疾病及死亡风险,依据过往病史等提供风险概率,虽有局限但潜力大。

AIGC开放社区
新闻资讯7

马斯克删除xAI「研究员」职位引爆网络!LeCun怒批:如此暴力将扼杀创新

马斯克宣布取消xAI「研究员」头衔,强调「工程师」重要性,引发与LeCun的激烈争论。LeCun认为研究与工程在多方面有区别,混淆会扼杀创新,争论也反映出AI企业不同组织架构模式。

新智元
推荐文章7

统一框架下的具身多模态推理:自变量机器人让AI放下海德格尔的锤子

当前先进机器人无法像人类自如用工具,现有多模态系统有局限。自变量机器人提出端到端统一架构,以统一表示学习和多任务多模态生成解锁具身多模态推理能力,实现范式转换。

机器之心
产品应用8

超脑未来WorldDreamer V4横扫多个权威榜单,世界模型进入群体智能时代

超脑未来发布 WorldDreamer V4,它以多智能体为基本单位,具多种核心能力。采用新预训练架构,引入 Masked Agent Modeling,用共享隐式世界状态带来新协同范式,还在多权威榜单领先。

机器之心
算法论文8

10秒视频token超5万,O(n²)跑不动?用后训练线性化框架实现1.71倍加速,推理成本大降|CVPR'2026

视频生成进入大规模时代,但计算成本高,自注意力复杂度O(n²)跑不动。研究团队提出LINVIDEO后训练框架,无需数据和重新预训练,实现视频扩散模型线性化替换,保持生成质量,加速推理并降低成本。

量子位
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十二】|位置嵌入 - 给模型装上"GPS"

文章指出Transformer对词顺序不敏感,引出位置嵌入概念。介绍经典的函数编码、可学习位置嵌入法及新主流RoPE,还提及为让模型处理长文本,在RoPE基础上用PI和YaRN等扩窗技巧。

AI大模型应用实践
新闻资讯8

祝贺小马智行港交所上市!|5Y News

11月6日,小马智行在港交所主板挂牌上市,成2025年全球自动驾驶最大IPO。此前已在美上市,构建“美股+港股”架构。创始人称站在商业化前夜,其核心业务多元,成本下降,还拓展全球版图。

五源资本 5Y Capital