新视角合成」共找到 3869 篇相关文章

新闻资讯7

一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”

NVIDIA 推出多模态大语言模型 OmniVinci,结合架构创与数据合成流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发争议。

AI前线
新闻资讯7

一边秀肌肉,一边设围墙,NVIDIA 发布 OmniVinci,性能碾压 Qwen2.5-Omni,却被骂“假开源”

NVIDIA 推出多模态大模型 OmniVinci,结合架构创合成数据流水线,训练 token 仅为 Qwen2.5 - Omni 的六分之一,却在多项基准测试表现更佳。但采用限制商业用途的许可证,引发“假开源”争议。

InfoQ
算法论文8

清华上交满分论文证明:强化学习并不能让大模型更会思考!

清华和上交在NeurIPS 2025的研究《Does Reinforcement Learning Really Incentivize Reasoning Capacity in LLMs Beyond the Base Model?》获满分。研究聚焦RLVR,发现强化学习不能让大模型更会思考,推理能力上限仍由基础模型决定。

AI工程化
算法论文8

NeurIPS 2025 Spotlight | 你刷到的视频是真的么?用物理规律拆穿Sora谎言

随着生成式AI发展,合成视频以假乱真,现有检测方法难泛化。本文介绍发表于NeurIPS 2025的文章,提出NSG统计量和NSG - VD检测方法,对未知生成范式检测效果好,实验表现超越现有方法。

机器之心
产品应用8

自媒体误读了 DeepSeek-OCR:一图胜千言

近期,DeepSeek-OCR引发关注,但很多媒体误读其为OCR工具,实际是视觉语言模型。它是为大文档等场景优化的视觉压缩与识别系统,架构颖,训练讲究,效果出色,为行业带来思路。

MacTalk
开源动态8

谷歌痛失王座?港科大贾佳亚团队DreamOmni2开源,超强P图暴击Nano Banana

港科大贾佳亚团队开源DreamOmni2,该模型基于FLUX Kontext,能处理多参考图像,在多模态编辑与生成上表现出色,超越谷歌Nano Banana等模型,还构建了测试集与数据构建范式。

新智元
新闻资讯7

被H-1B签证折磨10年,前微软科学家用AI「掀桌」

美国签证体系成本高、周期长、透明度低,前微软科学家Priyanka Kulkarni创办Casium,用AI改造签证服务,把材料准备时间大幅缩短,近期获500万美元种子轮融资。规下,其服务更显重要。

新智元
开源动态8

Nature点赞!哈佛MIT最作:AI科学家时代来了

哈佛MIT推出ToolUniverse,这一开源框架让AI用自然语言操作600+科学工具,解决了科学研究中AI智能体面临的工具格式不统一等问题,推动科研自动化升级,助力打造AI科学家。

新智元
开源动态8

清华&巨人网络首创MoE多方言TTS框架,数据代码方法全开源

清华与巨人网络联合首创 DiaMoE-TTS 多方言 TTS 框架,数据、代码、方法全开源。它基于 IPA 体系,有 MoE 架构和低资源适配策略,在多语种验证,为方言语音合成提供低成本、可扩展方案。

机器之心
8

刚刚,OpenAI最强DevDay剧透!奥特曼发神秘预告,Jony Ive压轴登场

OpenAI DevDay即将开幕,奥特曼发文称有东西助力AI开发。本届大会或成其在硅谷扩张宣言,将推出Agent Builder,或发布ChatGPT浏览器,还聚焦企业级AI应用,展示兴技术体验区。

新智元