智能视频云」共找到 4627 篇相关文章

推荐文章7

AI时代,最老的设计哲学反而最有效

50年前的Unix哲学‘万物皆文件’和‘文件夹即应用’正以意想不到的方式回归。过去因‘人类可理解性’被推崇,如今因AI能操作而重获重要性,文件夹成‘智能空间’,AI成其操作系统。

newtype AI
新闻资讯7

Meta 大裁员,华人科学家田渊栋受波及

据 Axios 报道,Meta 本周二从超级智能团队裁撤约 600 岗位,涉及多部门,TBD 实验室不受影响。华人科学家田渊栋等受波及,此次裁员或因研究官僚化,团队重组是为 AGI 愿景铺路。

AI科技评论
算法论文8

一张照片,一个3D「你」:计算所等提出HumanLift,实现高保真数字人重建

中国科学院计算技术研究所等机构研究人员提出 HumanLift 技术,基于单张参考图像重建高斯网数字人全身。该技术融合三维视频扩散模型和人脸增强,仅需单张人体图片就能重建高逼真三维数字人。

机器之心
开源动态8

Github 8.7K star 厉害!!! 一款轻量好用的web自动化项目!

Nanobrowser是开源Chrome扩展工具,专注AI驱动的网页自动化。免费且本地运行,保护隐私,支持多主流大模型。有多智能体协同等特点,还介绍了安装配置方法,是高效安全的网页自动化之选。

开源先锋
算法论文8

视觉感知RAG × 多模态推理 × 强化学习 = VRAG-RL

数字化时代视觉信息愈发重要,传统RAG方法处理视觉信息面临挑战。阿里巴巴通义实验室的VRAG - RL将强化学习引入多模态智能体训练,革新检索生成范式,提升视觉语言模型多方面能力,代码已开源。

PaperAgent
新闻资讯7

一个提示攻破所有模型,OpenAI谷歌无一幸免!

HiddenLayer研究发现一种「策略傀儡」提示,将危险指令伪装成配置片段,配上角色扮演,能让ChatGPT等主流大模型开启「无限制模式」。此策略利用训练弱点,难修复且可扩展,厂商需智能监控。

新智元
新闻资讯8

同一天两件大事!小模型直接掀翻千亿参数,走向效率为王

5月13日AI圈有两件大事,何恺明团队发布语言模型ELF,面壁智能开源MiniCPM-V 4.6。二者显示AI正从‘堆算力’转向‘省算力’,拉开AI轻量化浪潮序幕,未来小模型或成关注方向。

AI科技评论
开源动态7

一周斩获8k星!港大开源AI学习助手,学练研全流程覆盖,教师也要失业了?

港大开源的DeepTutor是AI个性化学习助手,利用多智能体协作等技术,有文档问答、难题解析等四大核心功能,能构建专属知识库,提供全流程辅导,为学、练、研打造一体化平台。

开源AI项目落地
新闻资讯8

OpenAI DevDay重磅新品曝光:Agent Builder来了!拖拽即可构建AI应用

OpenAI将在10月6日DevDay推出Agent Builder,用户能通过可视化画布拖拽构建AI智能体工作流,连接模型、工具等编排任务。其对手是n8n、Zapier,可集成第三方服务,降低AI应用开发门槛。

AI寒武纪
产品应用8

Qwen3-LiveTranslate:视、听、说全模态同传大模型!

Qwen3-LiveTranslate-Flash 是基于大语言模型的多语言实时音视频同传模型,依托 Qwen3-Omni 能力与海量数据,有多语言和方言支持、视觉增强等亮点,性能超主流大模型。

通义千问Qwen