新架构」共找到 4963 篇相关文章

新闻资讯8

深度讨论一轮模型发布:当智能进入月更时代 | Best Ideas

近期全球模型迎来高密度发布期,Anthropic、OpenAI、腾讯、DeepSeek 等纷纷推出模型。文章复盘了 Opus 4.7、GPT - 5.5、DeepSeek V4 等模型实测体验,探讨架构变化、能力边界与产业影响,还分析算力、token 价格等问题。

海外独角兽
算法论文8

NIPS2025|小红书智创AIGC团队提出布局控制生成算法InstanceAssemble

当下文本生成图像扩散模型有进展,但现有布局到图像生成方法在复杂场景表现不佳。小红书智创AIGC团队提出InstanceAssemble框架,从架构和评测应对难题,实现复杂布局下精确图像生成,有广阔应用潜力。

机器之心
算法论文8

ICML 2025 | 打破残差连接瓶颈,彩云科技&北邮提出MUDDFormer架构让Transformer再进化!

彩云科技与北邮联合提出多路动态稠密连接(MUDD)替代残差连接,提升Transformer跨层信息传递效率。实验显示,采用该架构的模型性能显著提升,论文等均已公开。

机器之心
新闻资讯8

摩尔线程的野心,不藏了

上市15天后,摩尔线程在首届聚焦全功能GPU的开发者大会上,围绕MUSA推出诸多品,包括GPU架构、芯片、智算集群和硬件产品,还将开源核心组件,构建生态,其架构定义未来AI产业格局。

量子位
开源动态8

原生理解生成统一:商汤开源SenseNova U1,用统一架构终结「缝合怪」多模态

商汤开源日日 SenseNova U1 系列原生理解生成统一模型,采用 NEO-unify 架构,只需 8B 小参数就能实现很多商业闭源模型效果。在多测评维度性能领先,还能实现连续性图文创作输出,解决理解与生成断层问题。

机器之心
开源动态8

华人学生立大功!王Mamba-3直击Transformer死穴,推理效率碾压7倍

一代开源架构Mamba-3发布,由CMU普林斯顿原班人马打造,15亿参数性能比Transformer高4%,长序列任务端到端延迟仅为其七分之一。它采用设计哲学,推理优先,有三大核心技术,还能与自注意力层混合提升检索能力。

新智元
算法论文8

ICCV 2025 | 小红书AIGC团队提出图像和视频换脸算法DynamicFace

小红书AIGC团队提出图像和视频换脸算法DynamicFace。该算法创性融合扩散模型与3D人脸先验,解耦身份与运动信息,设计双流注入架构和时序一致性模块,实验证明其在身份保真与运动还原上优势明显。

机器之心
产品应用8

d-Matrix用3D堆叠技术终结"内存墙",AI推理迎来光速时代

2025年9月Hot Chips上,d - Matrix展示3D堆叠数字内存计算技术,直击AI“内存墙”难题。其产品Corsair带宽强大,Pavehawk架构更有性能跃升,为AI推理开辟赛道,虽面临挑战但前景可期。

AIGC开放社区
开源动态8

社区发布丨全面开源!商汤日日SenseNova U1发布,迈向模型理解生成统一时代

商汤科技正式发布并开源商汤日日SenseNova U1系列原生理解生成统一模型,基于NEO - unify架构,实现模态集成向原生统一跨越,其轻量版在多项测试达同量级开源SOTA,还能连续性图文创作。

Hugging Face
算法论文8

SIGIR 2025 | 视频检索范式!北邮、北大等联合提出AV-NAS:首个音视频哈希搜索架构,让Mamba与Transformer自动“组队”

北邮、北大等团队提出 AV-NAS,在多模态视频哈希领域引入 NAS,构建含 Transformer 与 Mamba 的统一搜索空间。该方法能自动发现最优跨模态融合机制,揭示音频时序建模中“CNN + FFN”结构更优,代码已开源。

AI前线