三域融合大模型」共找到 8451 篇相关文章

算法论文8

比Transformer更强的架构来了?浙大新作Translution,一统卷积和自注意力

随着大模型发展遇瓶颈,浙大等校学者提出神经网络基础操作Translution,实现自注意力与卷积的融合统一,构建更普适神经计算机制。它性能超Self - attention,为新一代神经网络发展开辟新方向。

新智元
产品应用9

实时编辑、实时互动视频双旗舰,Vidu S2发布即体验

本文介绍生数科技推出的Vidu S2,专为实时交互编辑设计的AI视频模型,覆盖类核心能力,公开技术路线,发布当天开放体验与API,迭代仅用69天。

机器之心
产品应用8

字节Seedream 4.0将全量开放!抢先评测来了,我们摸索出AI生图20种「邪修」玩法

近日,字节跳动内测豆包・图像创作模型 Seedream 4.0,支持多模态生图,核心能力显著提升。它将全量上线并开放给企业客户。实测显示其多模态融合出色,还与谷歌 Nano Banana 对比,各有优势。

机器之心
算法论文8

震撼!AI物理「双修」:亥姆霍兹方程嵌进生成器,伪影当场消失

抢滩6G前夜,香港科技大学(广州)等机构发布PhyRMDM框架,将物理约束与生成模型能力融合,解决传统AI构建无线电地图预测失真问题,成果被顶会ACM MM 2025接收,代码和权重已开源。

新智元
开源动态7

以小博大,仅1.7B媲美gemini2.5-pro,达到SOTA文档解析性能

dots.ocr是多语言开源文档解析器,把布局检测和内容识别统一在视觉语言模型中,虽LLM仅1.7B参数,却达SOTA性能。介绍了其预训练阶段及SFT阶段关键策略。

PaperAgent
算法论文8

大象秒变挖掘机!维变形新突破,无需额外训练 | CVPR'26

南京大学与北京大学提出MorphAny3D,无需额外训练即可让维生成模型实现跨类别平滑变形。它通过创新注意力机制融合源与目标特征,精准控制结构与时序,效果远超传统方法,代码已开源。

新智元
开源动态8

北大联合Llama-Factory推出DataFlex:工业级数据动态训练系统

北大张文涛教授、鄂维南院士团队联合多机构推出大模型数据中心动态训练框架DataFlex。它是统一训练基础设施,纳入类核心能力,解决底层系统问题,在效率和效果上有提升,受社区认可。

机器之心
开源动态8

阿里开源 Wan2.2-Animate!统一角色动画和视频人物替换

阿里通义实验室开源 Wan - Animate,这是用于角色动画与替换的统一框架。它构建于 Wan 模型之上,支持角色动画和角色替换两项核心功能,性能超现有算法,还通过独特设计实现多种效果。

带你学AI
算法论文8

AI 也有长久记忆了!谷歌Nested Learning让AI拥有持续学习的生命力

Google Research科学家研究直指AI领域难题,其论文《Nested Learning: The Illusion of Deep Learning Architectures》已提交NeurIPS 2025。Nested Learning打破认知框架,提出大核心贡献,构建HOPE架构,性能优越,将改变终身学习应用领域。

AIGC开放社区
产品应用8

「AI黑客」来袭,Agentic AI如何成为新守护者?

AI 发展带来网络安全新威胁,如生成式 AI 诈骗、深度伪造等。业内共识是以 AI 对抗 AI,有模型防护、行业应用、政府协作类尝试。青藤云安全推出全栈式安全智能体「无相」,革新安全思维。

机器之心