新能安」共找到 7818 篇相关文章

产品应用7

容器可观测视角: SysOM延时监控助力定位业务抖动原因

云原生场景下,资源超卖和混合部署使宿主机与容器化应用资源竞争加剧,引发内核级延迟问题。本文结合实战案例,介绍用ack - sysom - monitor Exporter分析定位内核延迟,还介绍了SysOM监控及解决系统延时的方法。

阿里云开发者
推荐文章7

舍弃 VAE,预训练语义编码器让 Diffusion 走得更远吗?

纽约大学谢赛宁团队、清华&快手 Kling 团队的研究者指出 VAE 制约当前 Diffusion 范式,提出用预训练视觉模型作语义编码器改进。介绍了 VAE 不足及 RAE、SVG 工作如何解决问题,将扩散模型从‘压缩优先’转为‘语义优先’。

机器之心
新闻资讯7

中国机器人产业生态营在首钢园开营,构建产业协同范式

10月30日,中国机器人产业生态营在首钢园开营,由首程控股发起。其整合多方资源构建闭环式创生态,旗下基金已投资多家企业。生态营学员多元,罗振宇进行AI夜话分享,后续还有专家授课。

首钢园
产品应用8

超越Runway!Adobe发布神器:P视频比P图还简单

Adobe联合多高校推出AI模型EditVerse,它将图片和视频编辑整合,解决传统视频编辑复杂、数据稀缺问题。通过通用视觉语言、上下文学习力和知识迁移,其效果超Runway,还展现涌现力。

新智元
新闻资讯7

干家务一小时挣1000元,具身智时代人类岗位

机器人是AI热门领域,但面临数据荒。训练数据分真实与合成两类,前者质量高但成本高、规模有限,后者成本低。数据标注服务商高价回收做家务等视频作训练素材,各方努力下优质数据仍短缺。

量子位
算法论文8

轻量高效,即插即用:Video-RAG为长视频理解带来范式

现有视觉语言模型处理长视频面临诸多难题,厦门大学等联合提出轻量高效、无需微调的 Video-RAG 框架,采用多模态辅助文本检索增强生成,解决长视频理解问题,适用于多场景。

机器之心
开源动态8

告别「面瘫」配音,InfiniteTalk开启从口型同步到全身表达范式

传统video dubbing技术有局限,兴模型也有问题。美团视觉智部研发的InfiniteTalk引入‘稀疏帧video dubbing’,实现口型、表情、肢体与音频自然对齐,解决长视频生成难题,技术已开源。

机器之心
开源动态8

“边说边思考”,Mini-Omni-Reasoner 开创实时语音推理范式

Mini - Omni - Reasoner将推理力引入大型语音模型,开创“边说边思考”范式,实现实时语音推理与交互。推出Spoken - Math - Problems - 3M数据集,经四阶段生成流程构建。训练采用分阶段策略,性超基础模型。

GitHubStore
新闻资讯7

清北浙领跑两院院士候选!最年轻被提名人39岁

8月20日,中科院和工程院公布2025年院士增选有效候选人名单。清北浙领跑,最年轻候选人39岁。人工智地位提升,机器人技术成优先支持学科,反映国家对兴领域的重视。

量子位
开源动态8

模仿人类推理修正过程,阶跃星辰提出形式化证明范式 | 开源

阶跃星辰发布并开源形式化定理证明大模型 StepFun-Prover-Preview-7B 和 32B。采用两阶段监督微调、工具集成强化学习及 RL 与 SFT 迭代循环优化等策略,在基准测试集表现佳,还展示多个证明案例。

量子位