「多模态数据融合」共找到 3523 篇相关文章
Pixeltable:一张表搞定AI流水线
Pixeltable是统一声明式框架,能处理多模态AI流水线。它用表格接口替代传统复杂架构,有数据统一管理等核心能力,适用于多模态RAG等场景,内置支持主流AI服务,值得多模态AI项目一试。
首个GUI多模态大模型智能体可信评测框架+基准:MLA-Trust
MLA-Trust 是首个针对 GUI 环境下多模态大模型智能体的可信度评测框架,构建了涵盖四核心维度的评估体系,对 13 个模型深度评估,揭示可信度风险,还提供评估工具箱,推动其可靠部署。
首创郎园携手BFA影像传媒学院,成立AI视听产教融合实验室
8月19日,首创郎园与北京电影学院影像传媒学院共建的AI视听产教融合实验室在郎园Station园区揭牌。首创郎园称影视人才需求变了,实验室将依托双方优势培养AI视听人才,首个项目即将启动。
清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源
清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构和低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。
1.8亿个岗位数据分析揭秘,AI究竟取代了什么工作
Revealera联合创始人Henley Wing Chiu研究近1.8亿份全球岗位数据,发现2025年全球招聘岗位总量降8%。创意执行、监管环境等岗位跌幅大,AI相关、高层领导等岗位增长或表现坚韧,AI影响有选择性。
马斯克开源新模型:能实时抓取社交平台数据,20万块H100训练
马斯克旗下xAI开源去年最佳模型Grok - 2.5,6个月内还将开源旗舰模型Grok 3。Grok - 2.5可实时抓取社交平台X数据,用超20万块H100训练,性能超GPT - 4o等,应用场景广泛。
理解帮助生成?RecA自监督训练让统一多模态模型直升SOTA
统一多模态模型在视觉理解和生成能力上不平衡,常理解强但生成弱。本文提出重建对齐(RecA)自监督后训练方法,不改动架构,用未标注图像训练,在多模型实验中提升性能,部分达SOTA。
CSD7Z020 + CSD9361:从射频到基带,构建完整SDR数据通路
成都华微以CSD7Z020异构SoC搭配CSD9361宽带射频收发器搭建SDR硬件平台,打通从射频到应用层的数据通路,有灵活可编程、高集成度等优势,适用于多种场景。
企业数据“LLM ready”与“小Palantir”们的崛起 | AGIX PM Notes
文章指出当前 AI 仍处准备阶段,企业数据未就绪是落地大障碍,深层问题是流程 AI 原生化转型。还介绍本周市场、多家科技企业动态,以及巴菲特和芒格对 ETF 的看法及投资建议。
SFT在帮倒忙?新研究:直接进行强化学习,模型多模态推理上限更高
学界常用「监督微调(SFT)+ 强化学习(RL)」训练大模型。但新研究发现,SFT 会引发「伪推理路径」,阻碍推理进步。相比之下,直接进行 RL 训练,模型多模态推理上限更高,该团队训练的模型还刷新了纪录。