合成嵌入」共找到 332 篇相关文章

产品应用7

一致性对标Nano Banana,国产Vidu Q1同时支持7张参考 | 实测

AI生图赛道竞争激烈,专注视频大模型的Vidu推出Q1参考生图模型,能同时支持7张参考图,主体一致性对标谷歌Nano Banana。实测玩法多样,有高可操作性,现已全球同步上线。

量子位
产品应用8

谷歌nano banana正式上线:单图成本不到3毛钱,比OpenAI便宜95%

昨晚谷歌图像生成与编辑模型nano banana上线,正式名gemini - 2.5 - flash - image - preview。它有强大能力,成本低,有多种玩法,上线后测试火爆,在多个榜单成绩优异。

机器之心
产品应用7

Gemini CLI 新升级:深度集成 VS Code,终于不用在终端和编辑器之间反复横跳了

Google发布Gemini CLI重要更新,实现与VS Code深度集成,从架构层面解决AI编程助手的上下文感知问题。新版本有工作区上下文感知和原生差异对比界面两个核心功能,还给出部署要求。

AI工程化
新闻资讯7

开源套壳叫板Google?Perplexity新品发布,印度裔CEO放言5万美金撬走彭博千亿生意

本周,AI搜索公司Perplexity推出Comet浏览器,整合自家AI搜索与智能助手,挑战Google Chrome。其CEO Aravind Srinivas不认同走垂直路线,获马克·安德森支持。此外,他们还想以AI终结Bloomberg,盯上金融市场。

AI前线
产品应用7

SkyReels-Audio让嘴型和音频完美匹配不再难

音频驱动的动态人脸生成研究较少,昆仑万维提出SkyReels - Audio框架,基于预训练视频扩散变换器构建,支持无限长度视频生成与编辑,采用混合课程学习等策略,保障视频视觉保真度和时间一致性。

带你学AI
开源动态8

性能大涨!阿里开源新版Qwen3模型,霸榜文本表征

今日凌晨阿里开源Qwen3-Embedding和Qwen3-Reranker两款新模型,专为文本表征等任务设计,支持119种语言。测试显示其性能出色,在多语言文本表征和排序任务中超越众多模型,还采用了多种创新设计与训练方法。

AIGC开放社区
算法论文8

CVPR 2025 | SketchVideo让手绘动起来,视频生成进入线稿时代

中国科学院大学等团队提出基于线稿的可控视频生成和编辑方法SketchVideo,发表于CVPR 2025。它基于预训练模型添加线稿控制网络,解决现有视频生成模型可控性等问题,实现高质量视频生成与编辑。

机器之心
新闻资讯7

营收破亿,光轮智能完成数亿元 A 及 A+轮融资,揭秘机器人「数据荒」背后的生意经

近日,光轮智能完成数亿元 A 及 A+轮融资,已与全球头部企业合作,年营收破亿。其创始人谢晨博士指出机器人基础模型开发存在数据短缺问题,光轮通过仿真环境生成数据,是 NVIDIA 生态核心伙伴。

Founder Park
新闻资讯8

刚刚,OpenAI发布首个AI浏览器ChatGPT Atlas!谷歌最怕的来了

OpenAI发布AI浏览器ChatGPT Atlas,原生嵌入ChatGPT,有侧边栏、浏览器记忆与智能体模式,可在页面内理解意图并完成任务。谷歌股价应声下挫,AI浏览器之战升温。

新智元
新闻资讯8

中科院“二氧化碳制糖”新成果全网热议!不依赖光合作用,“迈向深空前置技术”

中国科学院天津工业生物技术研究所提出新技术,首次构建体外转化系统,打通“CO₂→甲醇→蔗糖”合成路径。绕过植物光合作用制糖,能耗低、效率高,对解决全球变暖、粮食危机有启发。

量子位