「智能创作」共找到 3782 篇相关文章

新闻资讯7

2025AI红利爆发!新智元创始人与5位清华系大咖「探索对话」

11月5日,「新浪新闻・2025探索大会」举办,新智元创始人杨静主持探索对话环节,多位嘉宾围绕「如何掌握科技创新的时代红利」展开交流,探讨释放红利路径,还提及协同创新和出海对放大红利的重要性。

新智元
产品应用7

跟这个音乐Agent聊会儿,分分钟生成抖音神曲 | 对话音乐创作Agent产品Tunee

量子位智库对话国内首个音乐创作Agent产品Tunee负责人贾朔,探讨了产品适配用户群体、核心交互形式、解决需求模糊性等问题,还提及产品价值、迭代方向及推出智能硬件的原因。

量子位
算法论文8

内存直降50%,token需求少56%!用视觉方式处理长文本

在NeurIPS 2025论文中,南京理工大学等校研究团队提出VIST框架,为大语言模型长文本高效推理提供视觉解决方案。它模仿人类阅读机制,让模型具备选择性阅读能力,减少Token需求和内存使用。

新智元
开源动态7

Wan2.2-Animate又火了,5分钟让抠脚大汉秒变高冷女神。

阿里开源模型Wan2.2 Animate又火了,用照片和视频就能生成换脸视频,表情动作复刻佳。它上限高,还能变声,可用于舞蹈视频、影视二创等,但手指易崩坏。模型开源,有积极意义也有风险。

数字生命卡兹克
新闻资讯7

创新中心 | 2025首届“幻镜”AI视听测评季成果在京发布,探索AI视听领域建立科学测评体系

2025年10月28日,“人工智能赋能精品创作沙龙”暨首届“幻镜”AI视听测评季成果发布会在京举办,活动旨在为AI视听领域建科学测评体系。会上公布测评结果、优秀作品片单,发布研究分析报告。

郎园Station
算法论文8

阿里新研究:统一了VLA和世界模型

阿里达摩院等提出WorldVLA框架,融合视觉语言动作模型与世界模型。它用三套分词器编码,解决传统自回归模型问题,经联合训练,实验显示其性能优,两模型还能相互助力。

量子位
开源动态8

边打字边出片,交互式生成长视频!英伟达联合MIT开源新SOTA

AI拍长视频不再难!英伟达联合MIT推出LongLive,可实时交互生成流畅画面,解决传统方法卡顿、不连贯等痛点。它能生成15秒到240秒视频,性能达SOTA,还靠三把“钥匙”解决长、顺、快难题。

新智元
开源动态8

7.5K Star!HKUDS开源AI全栈开发框架,产品经理的Demo神器!

AI时代从论文到产品Demo开发全链路工作耗时费力,现有Agent也有诸多问题。香港大学数据科学实验室(HKUDS)开发的DeepCode开源框架,定位“全自动AI软件开发框架”,可一键从论文/需求生成完整项目,已获7.5K Star。

开源星探
开源动态8

23.6K star!微软AI项目硬核开源,带飞你的电脑!

微软开源项目 `OmniParser` 是超级智能“数字助手”,能像人一样“看懂”屏幕元素并操作。它精准识别小图标、响应快、开发便捷、兼容大模型且跨平台,目前在Github获23.6K star。

开源先锋
开源动态7

从科学论文自动生成视频

该项目解决学术演示两核心问题,用智能体PaperTalker生成视频,还设Paper2Video基准评估。介绍了PaperTalker使用步骤,含环境、配置、推理,也说明了Paper2Video评估指标及运行方法。

GitHubStore