视频编解码」共找到 1088 篇相关文章

产品应用8

万万没想到,这家央企竟让香农和图灵又“握了一次手”

中国电信人工智能研究院研发布局的智传网(AI Flow),让信息技术和通信技术融合。在WAIC中,李学龙提出智传网三律,即信容律、同源律和集成律,打破传递智能的‘壁’,为数字世界带来深远影响。

量子位
算法论文8

UofT、UBC、MIT和复旦等联合发布:扩散模型驱动的异常检测与生成全面综述

多伦多大学、麻省理工学院等高校研究者合作完成长文综述,聚焦扩散模型在异常检测与生成领域的应用,梳理图像、视频等异常检测任务进展,提供分类体系,展望未来趋势。

机器之心
算法论文8

苹果新作:内化视觉思考,推理提速 5 倍

Apple研究团队提出Internalized Visual Thinking(IVT),一种将预测性世界建模能力内化到模型表征中的后训练框架。它在训练时预测未来,推理时直接回答,相比Visual CoT推理提速超5倍。

机器之心
新闻资讯8

时间会证明光的

市场曾质疑AI资本开支高增长的持续性,如今随着头部模型公司ARR非线性爆发式增长,AI商业正向循环打通。在AI硬件产业链中,光互联是国内厂商全球参与度最高、份额最稳固的环节,正迎来最好时代。

芯师爷
开源动态7

本周 5 个实用的 Github 开源项目,真香!

文章介绍本周5个实用Github开源项目。有资源聚合媒体中心stremio-web,AI原生安全测试平台CyberStrikeAI,本地优先AI程远控工具hapi,智能股票分析系统daily_stock_analysis,纯前端JavaScript GUI智能体框架PageAgent。

开源先锋
8

光年之外居然做了能用Skills的AI浏览器:超实用实用案例+现成脚本

光年之外团队推出 Tabbit 浏览器,填补国内空白,有对话、妙招等 5 大核心功能。文章用5个案例展示其便捷性,如一键成稿、旅行规划等,还能解决收藏难题、增强网页功能,适配国内网站。

歸藏的AI工具箱
新闻资讯7

训练机器人方式对了吗?英伟达DreamZero双榜第一新反思

NVIDIA的DreamZero在RoboArena和MolmoSpaces基准测试双登顶。分析文章《Why is DreamZero so good at robotics?》从多维度拆解其表现突出原因,质疑传统认知,如数据量并非万能,模型规模和信息输入方式也很关键。

机器之心
产品应用8

锁定角色,「多主体」也可控!个性化文生图,给你PS般交互体验

LayerComposer革新个性化图像生成,能让用户如在Photoshop般操控元素位置、大小,解决传统方法交互性与多主体扩展难题。它有分层画布、锁定机制、模型–数据共设计三大特点,实验表现出色,未来将促进人机协同创作。

新智元
开源动态7

OmniAvatar震撼开源!阿里夸克开源全新音频驱动角色模型

音频驱动人体动画技术有局限,阿里夸克团队推出OmniAvatar模型。它用逐像素多层次音频嵌入和LoRA训练法,解决唇动同步等问题,适用于多领域,但也存在颜色偏移等不足。

带你学AI
新闻资讯7

征集全国首部AI大模型私有化部署标准起草单位和个人!

智合标准中心组织起草的《人工智能大模型私有化部署技术实施与评价指南》团体标准正式立项,这是国内首部相关标准。它全流程覆盖、多方面融合、三方协作,现正征集起草单位和个人。

机器学习AI算法工程