语义向量化」共找到 994 篇相关文章

推荐文章7

2025.7.4上午 | 视觉智能驱动的多模态对齐与推理的近期系列工作分享 - 复旦博士生王思尹

本次分享由复旦博士生王思尹围绕‘视觉智能驱动的多模态对齐与推理’展开,介绍多模态大模型探索研究,涉及跨模态组合语义理解、视觉参与推理及基于视觉建模世界完成行动等内容。

深度学习自然语言处理
产品应用7

数据「熵增」时代,AI 如何以标准重构治理秩序?

Agent热潮下数据分析与治理有短板,Gartner预测到2027年多数数据治理举措或失效。瓴羊Dataphin高级技术专家周鑫阐述以数据标准为核心的数据治理方法论及AI赋能自动化治理实践路径。

InfoQ
新闻资讯7

推理能力大比拼,《推理模型综合测评报告 2025 》正式发布

过去半年,推理能力成大模型新分水岭。InfoQ研究中心评测八款热门模型,围绕五大维度,用超90%原创试题。发现各模型在不同维度表现有差异,推理模型发展正从‘一个大脑’变为‘带工具的多能智能体’。

InfoQ
新闻资讯8

一场“直面行业真问题”机器人比赛的万字观赛报告|甲子光年

甲子光年发布ICRA上WBCD赛事观赛报告。该赛聚焦双臂机器人,设生命科学、物流打包、餐桌服务挑战。从实际需求出发,吸引全球团队。各赛展现不同技术亮点,如洛桑联邦理工线控、卡内基梅隆神经 - 符号架构等。

甲子光年
开源动态8

文生图进入R1时代:港中文MMLab发布T2I-R1,让AI绘画“先推理再下笔”

港中文MMLab团队发布首个基于强化学习的推理增强文生图模型T2I - R1。它提出双层级CoT推理框架和BiCoT - GRPO强化学习方法,解决生成评估难题,为多模态生成提供新范式。

量子位
新闻资讯7

刚刚,OpenAI任命新CEO!

OpenAI宣布39岁的Fidji Simo出任「应用CEO」,奥特曼汇报。奥特曼仍为CEO,未来专注研究、算力与安全。Fidji经验丰富,曾在Facebook工作十年,还担任过Instacart CEO。

新智元
开源动态8

终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成

过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。

量子位
算法论文8

TACL 综述 | 别只卷架构了——长文本模型的能力天花板,其实是数据决定的

该 TACL 综述首次从数据视角审视长上下文语言模型,指出长上下文能力本质是数据驱动。它建立分类体系,明确高质量长文数据条件,给出核心能力的数据配方与评估法,还整理数据集和基准,提出待解问题。

深度学习自然语言处理
算法论文8

世界模型炒作了半年,反应速度还不如 VLA?穆尧团队和百度智能云给出最新解法

生成式世界模型用于机器人控制备受争议,因其推理延迟高。上海交通大学 ScaleLab 团队等联合发布 AHA - WAM,解决推理延迟和时空分辨率错配问题,在任务成功率和推理速度上领先,还需系统协同推进落地。

InfoQ
新闻资讯8

触觉具身来了个梦之队:天使轮近亿

5月27日,上海新智具身智能科技有限公司宣布完成近亿元天使轮融资。该公司源自复旦大学,核心团队实力强。它聚焦触觉具身智能,构建技术闭环,在数据采集、模型训练等方面有进展,已在工厂落地POC验证订单。

量子位