训练推理协同」共找到 3882 篇相关文章

算法论文7

ImageNet分数越高,生成反而越糊?iREPA给出解释

Adobe Research论文指出,视觉模型在ImageNet分类准确率高,生成效果未必好,全局语义强易压扁空间结构。iREPA修改REPA训练流程,削弱全局干扰,提升了生成质量。

新智元
产品应用8

超越Runway!Adobe发布新神器:P视频比P图还简单

Adobe联合多高校推出AI模型EditVerse,它将图片和视频编辑整合,解决传统视频编辑复杂、数据稀缺问题。通过通用视觉语言、上下文学习能力和知识迁移,其效果超Runway,还展现涌现能力。

新智元
算法论文8

西工大张伟伟等:强化学习如何练就近距空战制胜法则?| 航空学报CJA

本文针对空战智能化需求,构建高保真近距对抗仿真平台,提出优化自博弈强化学习架构。该智能决策系统与成熟飞行员近距格斗胜率超75%,为智能空战发展提供技术支撑。

力学与人工智能
算法论文7

首个多人对话视频生成框架MultiTalk,角色有表情还能互动

现有音频驱动人体动画方法多聚焦单人,处理多音频流能力弱、指令跟随有局限。中山大学提出多人对话视频生成新框架MultiTalk,介绍了技术原理,演示效果显示其指令跟随能力强、伪影少。

带你学AI
新闻资讯7

Show me《指环王》!卡帕西强推大模型评测新基准

大神卡帕西宣称Anthropic用《指环王》给大模型评测上强度,这一‘指环王基准’正接替‘鹈鹕骑自行车’SVG测试。虽Opus 5生成的画面粗糙,但网友测试展现出丰富创意,不过新测试也引发争议。

量子位
产品应用7

优步通过实时信号与 Listwise 排序改进餐厅推荐

优步在Uber Eats推荐系统引入实时用户信号与Listwise排序法,用实时信号处理层替换早期特征流水线,还引入Listwise排序优化候选餐厅排序,降低特征漂移,保障系统性能。

InfoQ
新闻资讯7

Claude惊人真相被教授曝光:思考过程加密,给钱也看不到!

Anthropic推出extended thinking,包装成让用户看到思考过程的透明标杆,但实际仅展示部分内容,核心思考被加密。开发者发现异常,密码学教授逆向有发现,这暴露了其透明度悖论和信任问题。

新智元
新闻资讯7

Agent Token焦虑:当每次对话都在「烧钱」,技术如何破局?| GAIR Live 029期预告

GAIR Live 029 期线上圆桌将直击 Agent Token 焦虑的底层技术逻辑,邀请技术负责人从架构重构与系统优化双重视角,拆解 Claw 类产品如何从烧钱走向省钱。探讨成本解剖、架构升维、系统优化等核心议题。

AI科技评论
开源动态8

支持30种语言,多种中文方言 [四川话、粤语等]的颠覆性无分词器TTS系统

VoxCPM是无离散音频分词器的语音合成系统。VoxCPM2基于MiniCPM - 4构建,有20亿参数,支持30种语言和9种中文方言,具备音色设计、可控声音克隆等特性,还完全开源,商用就绪。

GitHubStore
新闻资讯7

算力都去哪儿了?这个 Seedance 2.0 生成的梗视频给出了答案

有人用Seedance 2.0将Anakin and Padmé梗做成AI视频讽刺AI行业。视频对话暗示算力用途与宣称不符,最后几秒AI将帕德梅形象处理成擦边画风,揭示算力真实去向。

宝玉AI