「图像创作」共找到 764 篇相关文章
创新中心 | 2025首届“幻镜”AI视听测评季成果在京发布,探索AI视听领域建立科学测评体系
2025年10月28日,“人工智能赋能精品创作沙龙”暨首届“幻镜”AI视听测评季成果发布会在京举办,活动旨在为AI视听领域建科学测评体系。会上公布测评结果、优秀作品片单,发布研究分析报告。
刚刚,Anthropic 发布 Claude for Life Sciences,目标生物科研全流程
Anthropic推出Claude for Life Sciences,全方位布局生命科学领域。它配备Skills功能,生物学测试表现提升,能解读图像、分析数据。还深度整合科研生态,应用场景广,获众多药企、学术机构青睐,还有AI for Science计划。
边打字边出片,交互式生成长视频!英伟达联合MIT开源新SOTA
AI拍长视频不再难!英伟达联合MIT推出LongLive,可实时交互生成流畅画面,解决传统方法卡顿、不连贯等痛点。它能生成15秒到240秒视频,性能达SOTA,还靠三把“钥匙”解决长、顺、快难题。
多模态推理最高加速3.2倍!华为诺亚新算法入选NeurIPS 2025
华为诺亚方舟实验室研究入选NeurIPS 2025,其提出视觉感知投机推理(ViSpec)框架,解决草稿模型处理图像信息效率难题,在不牺牲生成质量下,对主流VLM最高达3.22倍推理加速。
苹果传统强项再发力,视觉领域三种模态终于统一
苹果在大模型领域常受挫,但计算机视觉研究是其强项。其研究团队提出 ATOKEN,这是首个能在主要视觉模态统一处理的分词器,兼顾重建质量与语义理解,成果朝通用视觉表征迈进一步。
行业首场丨00 后 Agent 应用创业者的行业观察
外滩大会智能体论坛举办全员 00 后的 Agent 主题圆桌。嘉宾探讨 2025 是否为 Agent 元年,还分享 Agent 应用方向、场景价值、落地卡点、AI Coding 发展及基模与垂直 Agent 关系等观点。
从 AI 3D生成转型AI原生影视公司,Utopai Studios想「稍微」改造下好莱坞
2022年创立的AI 3D生成公司Cybever转型为Utopai Studios,获好莱坞人士投资,还推出两部AI影片计划。其00后掌舵者Cecilia Shen称要变革制作范式,解决AI视频模型瓶颈,解放创作者。
谷歌发布Nano Banana官方保姆级开发教程,代码给你喂到嘴边
谷歌为Nano Banana新模型发布官方保姆级开发教程。介绍了使用Google AI Studio免费测试方法,阐述环境准备,如获取API key、设置结算账户、安装Gen AI SDK,还展示代码实战,以及和模型沟通的技巧。
让AI作画自己纠错!随机丢模块就能提升生成质量,告别塑料感废片
来自清华、阿里等的团队推出S² - Guidance方法,通过随机丢弃网络模块动态构建子网络实现自我修正。它避免了其他方法繁琐调参,在文生图和文生视频任务中显著提升生成质量与连贯性,且计算高效。
稚晖君新大招:机器人二次开发0门槛了!
在智元机器人首届合作伙伴大会上,联合创始人稚晖君发布机器人动作与表达创作平台灵创平台。它以AI加持,能将机器人二次开发抽象成模块化工具,降低难度,适配多款机器人,10月上线beta版。