跨模态建模」共找到 301 篇相关文章

算法论文8

ICLR 2026|首个微观世界模型MicroVerse来了,AI开始模拟看不见的世界

过去两年,世界模型成为大模型演进重要方向,但现有模型多聚焦宏观世界。本文提出MicroVerse模拟框架,将研究边界拓展到微观尺度,还推出MicroWorldBench评测基准和MicroSim - 10K数据集,推动AI从视觉模拟迈向科学模拟。

机器之心
算法论文8

2026 AI Memory最新综述:从理论到实战,一文读懂AI记忆的进化全景

2026年北邮百家AI MemoryOS团队联合华为发表《Survey on AI Memory》,涵盖AI记忆理论基础、分类体系、架构、评估方法与前沿趋势,还提出4W分类法,剖析了发展挑战与未来方向。

PaperAgent
推荐文章7

人生文件系统

文章探讨用AI管理人生,提出把人生建模为统一文件系统。还指出多数人建目录树后文件夹易空,分享设计原则,如采用最小可行结构、写入阻力最小化、视项目为一等公民等。

newtype AI
算法论文8

任意条件,「可控」文生图扩散模型综述 | TPAMI'25

北京邮电大学团队在顶级期刊IEEE TPAMI发布综述,探讨文生图扩散模型可控生成技术,将核心问题概括为如何注入新型条件信号并稳定控制,从任务和方法层面梳理技术,还提及应用场景与未来方向。

新智元
开源动态8

Lumina-DiMOO:多模态扩散语言模型重塑图像生成与理解

上海人工智能实验室推出多模态扩散语言模型 Lumina - DiMOO,它基于离散扩散建模,打破多模态任务壁垒。相比传统自回归架构模型,它解决了生成慢、质量受限等问题,在多项评测中夺魁。

机器之心
算法论文8

NeurIPS 2025 | ARGRE框架实现高效LLM解毒:自回归奖励引导,安全对齐更快、更准、更轻

北航等机构研究提出自回归奖励引导表征编辑(ARGRE)框架,在LLM潜在表征空间可视化毒性变化路径,实现测试阶段高效“解毒”。实验显示其降低毒性、缩短推理时间,不影响模型能力,优于基线方法。

机器之心
算法论文8

比Transformer更强的架构来了?浙大新作Translution,一统卷积和自注意力

随着大模型发展遇瓶颈,浙大等校学者提出神经网络基础操作Translution,实现自注意力与卷积的融合统一,构建更普适神经计算机制。它性能超Self - attention,为新一代神经网络发展开辟新方向。

新智元
推荐文章7

从大数据到好猜想:如何用大模型做市场研究?

文章指出大模型重塑用户需求调研,并非按常规用AI获取和清洗数据,而是让模型扮演真实用户。以品牌分析社交媒体数据为例,探讨大数据局限,还介绍‘好猜想’标准,最后说明Atypica.AI能构建消费者智能体解决归纳问题。

Founder Park
产品应用8

用完字节的火山 VikingDB,我都不舍得告诉别人

作者所在团队与字节跳动的VikingDB RAG产品合作研发墨问“知识库”功能。介绍了VikingDB的向量库、知识库和长期记忆库能力,对比传统数据库凸显其优势,还阐述了相关技术推动信息连接变革。

MacTalk
8

快手AgentX:推荐系统开始自我迭代

过去十年推荐系统核心在‘建模’与‘工程’,但日常迭代瓶颈在研发生产方式。快手 AgentX 团队提出 Agent 驱动研发闭环,在快手 App 业务部署中跑通完整闭环,提升效率与业务收益。

机器之心