多模态数据融合」共找到 3543 篇相关文章

新闻资讯7

一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”

NVIDIA 推出多模态大模型 OmniVinci,结合架构创新与合成数据流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发“假开源”争议。

InfoQ
算法论文8

NeurIPS 2025 Spotlight | 条件表征学习:一步对齐表征与准则

文章指出传统表征学习处理图片和商品信息时存在局限,针对性有监督训练成本高,多模态大模型使用成本也需考虑。为此提出即插即用的条件表征学习方法 CRL,实验显示其在下游任务表现优异。

机器之心
推荐文章7

从 MCP 到 Agent:构建可扩展的 AI 开发生态的工程实践

本文整理自字节跳动 Trae 架构师陈仲寅在 AICon 2025 上海的分享。探讨通过 MCP 及 Agent 构建可扩展生态体系,涵盖自定义 Agent 设计、与工具集成及共建等内容,还展望技术演进方向与 AICon 深圳站信息。

AI前线
开源动态8

Codex给V4-Flash装上眼睛,DeepSeek也会文档OCR

GitHub上的项目codex-vision-proxy让接进Codex的DeepSeek能看图,不用换模型或等官方,装本地代理即可。它还附带视觉工具包,在智能文档解析和OCR上潜力大,证明多模态能力可长在管道上。

CourseAI
新闻资讯7

写在 Claude Design 发布之后:如果明天巨头做掉了你的核心功能,你该怎么办?

Anthropic 发布 Claude Design,可从提示词生成设计稿等,让 Figma 市值蒸发。这引发对 AI 应用层产品的思考,当基础模型厂商收回能力,靠能力缺口的产品将失重,应用层需从工作流、数据等找机会。

AI科技大本营
算法论文8

在失败中进化?UIUC联合斯坦福、AMD实现智能体「从错误中成长」

伊利诺伊大学厄巴纳 - 香槟分校等团队发布论文,剖析LLM智能体失败机制,提出可自我修复的创新框架AgentDebug。研究指出智能体常见失败类型,构建错误分析体系、数据集,实验显示该框架效果显著,为AI可靠性提供方案。

机器之心
新闻资讯8

前小米 OS 高管创业:你的下一部「手机」未必是手机

前小米OS高管董红光创立光帆科技,他认为AI将重塑消费电子行业,未来交互是“需求式”和“多模态”的,手机或不再是最适配设备,穿戴设备或先变革,未来多设备联动由AI大脑调度。

Founder Park
算法论文8

知识图谱推理新sota,兼顾性能+效率!中科大新作 | NeurIPS'25

知识图谱推理应用广泛,但现有方法面临推理效率低、表达能力不足等挑战。中科大团队提出DuetGraph,采用双阶段粗到细推理框架与双通路全局 - 局部特征融合模型,平衡推理精度与效率,缓解过平滑问题。

新智元
算法论文8

国产AI击败Meta:ReasonRank荣登BRIGHT榜单第一

基于LLM的段落排序方法中,listwise排序虽有优势,但当前重排器难处理复杂推理查询。ReasonRank通过生成推理密集型训练数据及两阶段后训练,赋予listwise重排序器强推理能力,在BRIGHT榜单击败Meta。

CourseAI
算法论文8

建模世界偏好:偏好建模中的Scaling Laws

研究首次揭示人类偏好建模遵循Scaling Law,从论坛收集数据在Qwen 2.5模型训练,发现测试损失随训练规模指数增长线性下降。提出建模世界偏好,论文和模型已开源,还探讨了偏好建模可扩展性等问题。

通义千问Qwen