实时生成技术」共找到 4833 篇相关文章

产品应用7

跟这个音乐Agent聊会儿,分分钟生成抖音神曲 | 对话音乐创作Agent产品Tunee

量子位智库对话国内首个音乐创作Agent产品Tunee负责人贾朔,探讨了产品适配用户群体、核心交互形式、解决需求模糊性等问题,还提及产品价值、迭代方向及推出智能硬件的原因。

量子位
开源动态8

百度0.9B参数模型登顶全球第一,聊聊PaddleOCR-VL背后的技术细节

百度PaddleOCR-VL模型仅0.9B参数,在OmniDocBench V1.5榜单获92.6分全球第一,在多能力维度达业界最佳,能处理109种语言。其采用两阶段架构,结合优质训练数据,实现高性能与低内存、快速度的平衡。

AIGC开放社区
开源动态8

开源AI教育视频生成神器,3Blue1Brown风教学动画一键搞定!

新加坡国立大学Show Lab团队开源Code2Video,能让代码变高质量教育视频,逻辑是用代码驱动视觉效果。它有智能解析等特性,可解决传统教学视频形式单一等问题,应用场景广泛。

开源星探
新闻资讯7

苹果机器人负责人也被小扎挖走了!浙大校友,任职Meta机器人技术一号位

苹果又失去四名AI研究员,其中机器人研究小组首席AI研究员Jian Zhang跳槽到Meta,基础模型团队三人分别去OpenAI和Anthropic。苹果AI进展不顺,此前已有6人跳槽,离职潮预计还会持续。

量子位
算法论文8

从需求分析到代码生成,LLM都能干点啥?一文读懂291个软工Benchmark!

大语言模型重塑软件工程各环节,但缺乏评估其在该领域表现的系统工具。浙江大学等机构团队首次对291个软件工程Benchmark系统综述,分析现状、痛点并给出改进方向。

新智元
开源动态8

一张图0.1秒生成上半身3D化身!清华IDEA新框架入选ICCV 2025

清华和IDEA研究人员提出新框架GUAVA,可0.1秒从单图创建上半身3D化身。它解决了现有方法在ID一致性、效率等方面的局限,实验显示其在渲染质量和效率上优于现有2D和3D方法,代码已开源。

量子位
推荐文章8

一文全解析:AI 智能体 8 种常见的记忆(Memory)策略与技术实现

本文剖析8种常见AI记忆方案,如全量记忆、滑动窗口等,分析其原理、特点和适用场景,还给出模拟代码助理解。不同策略各有优劣,适用不同对话场景,能为项目评估、选择和实现Memory方案提供参考。

AI大模型应用实践
产品应用8

Qwen3-Embedding 全揭秘:从技术到服务,打造高效AI产品的关键路径

文章全面揭秘 Qwen3-Embedding,介绍其核心原理、优势、应用场景。还给出在 PAI 和百炼平台的使用方法,含部署、推理、微调等。通过对比实验,凸显其低延迟、低成本特点,未来将成语义理解核心设施。

阿里云开发者
新闻资讯7

好玩!AI“穿越”新玩法火了:根据12岁照片生成23岁的你

AI“穿越”新玩法火了,外国网友让ChatGPT根据12岁照片推测23岁样子还挺准。很多人参与,还有新奇玩法。作者用不同名人照片测试ChatGPT、抖音小程序和豆包,结果各有偏差,但玩法有趣。

量子位
新闻资讯8

中科院“二氧化碳制糖”新成果全网热议!不依赖光合作用,“迈向深空前置技术

中国科学院天津工业生物技术研究所提出新技术,首次构建体外转化系统,打通“CO₂→甲醇→蔗糖”合成路径。绕过植物光合作用制糖,能耗低、效率高,对解决全球变暖、粮食危机有启发。

量子位