数据生成方案」共找到 4885 篇相关文章

开源动态8

阿里AI 重磅第4发:电影级MOE 视频模型Wan2.2正式开源!

阿里通义团队开源电影级视频生成模型Wan2.2,将光影、色彩、镜头语言装进模型,支持60多参数自由组合。它是业界首个用MoE架构的视频生成模型,推理省计算资源,性能超主流模型,获国外网友盛赞。

AGI Hunt
产品应用7

SQL玩转多模态AI,轻松搞定图片+文本混合搜索

在AI驱动智能商业时代,传统搜索系统难满足需求,AI检索系统又面临数据搬运和工具链割裂难题。本文提出用原生SQL实现多模态智能检索,基于PolarDB融合AI引擎,通过SQL调用服务,无需迁移数据与搭建独立服务。

阿里云开发者
新闻资讯7

机器人整机是“有限游戏”?对话星海图创始人:具身智能商业化的三个阶段,终点是卖Token

星海图CEO高继扬等提出具身智能三重跃迁,发布新模型并开源,首秀自研机器人。公司从整机起步,联合建数据公司,规划数据量。其商业模式分三阶段,认为中国具身基础模型能力有望超美。

AI前线
产品应用8

Qwen-Image-2.0: 字字清晰,张张细腻

阿里云推出Qwen-Image-2.0图像生成基础模型,具专业文字渲染、细腻真实质感等特色。在AI Arena盲测中表现优越,能精准生成复杂内容,文字渲染有准、多、美、真、齐特点,图像编辑能力也得到增强。

千问Qwen
算法论文8

AST | 西交大牛笑天、陈刚等:基于多尺度网格融合技术的复杂三维构型流场时空智能推理方法

文章针对复杂三维外形的强非线性非定常流场推理难题,提出MSGF数据预处理方法与DTECAU - 3D模型联合框架。MSGF解决数据提取难题,DTECAU - 3D解决传统U - net问题,经测试验证该框架效果良好。

力学与人工智能
产品应用8

全球最强AI音乐模型,现在来自中国!高晓松也来围观了

昆仑天工发布音乐模型Mureka V8,实测打败硅谷Suno V5成世界第一。它能生成完整可发布歌曲,结合MusiCoT技术实现从“能生成”到“能发布”跨越。高晓松等认可其变革潜力,昆仑天工联合太合音乐打通产业链。

量子位
产品应用7

打工人五一自救指南:把活全甩给AI,准备免打扰出门

五一将至,为避免假期工作内耗,可安装百度智能云打造的AI助手DuMate。它支持多模态理解与生成,能跨应用完成复杂任务。经测试,它可高效处理整理文件、生成报告等工作,还能并行处理多项任务。

量子位
新闻资讯7

伯牙智能创始人兼CEO刘欣:灵巧手重塑具身智能|甲子引力X

2024年4月28日,「AI共潮生—2025甲子引力X科技产业新风向」大会举办。伯牙智能CEO刘欣分享称,AI在物理世界赋能需灵巧手,其操作发展尚处初期,有软硬件挑战,还提出对数据及触觉传感能力的新思考。

甲子光年
产品应用8

真碾压Sora了!谷歌Veo 3首次实现音画同步,视频模型直接「开口说话」

谷歌正式发布Veo 3,它能生成高质量视频,还能理解原始像素,自动生成与画面同步的对话、多种音效。得益于DeepMind的V2A底层技术,其音画合成功能领先。虽有时长和使用门槛限制,但已足够震撼。

机器之心
新闻资讯7

刚刚,Manus恢复独立运营

曾被Meta收购的Manus宣布恢复独立运营,为满足数据合规,需删除部分收购后产生的数据。它开发备份和恢复工具,还准备新功能拓展通用AI智能体能力边界。其出道曾即巅峰,后被收购,如今又回归。

量子位