产品应用8
谷歌Gemini Omni:开启AI视频新纪元
新智元
AI 摘要
谷歌推出Gemini Omni,号称迈向万能生成模型第一步。它能实现对话式视频编辑,有涌现能力。谷歌还为其设Avatar Flow、强制水印等限制,显示AI战争新趋势。
阅读原文 · 新智元
全网实测Gemini Omni!一句话改视频,草图变大片
谷歌在Google I/O大会推出Gemini Omni,它结合推理与生成能力,在多方面有重大飞跃,能生成逼真视频等。它打破命名体系,训练目标不同,有涌现能力,谷歌还为其设置限制。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
开源动态8
Meta 开源本地运行智能体模型 Muse Glimmer
Meta AI Research 推出 300 亿参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可证。它专为本地工作流设计,能在消费级硬件运行,经多项优化,在基准评估中表现出色,还支持多种框架。
AI前线
产品应用7
谷歌 GR2 模型:让机器人有了‘腿’
谷歌发布 Gemini Robotics 2(GR2),能将相机图像和文字指令转为机器人关节控制命令,可同时控制人形机器人腿、躯干、手臂和手部,简化模型训练和设计,不过谷歌未公布其基础模型等信息。
DeeplearningAI
开源动态8
阿里开源Qwen3.8-27B,性能直逼顶尖模型
阿里Qwen团队开源Qwen3.8-27B,上线2天登顶Hugging Face全球大模型趋势榜,下载破百万。其性能超Opus4.6,与顶尖模型相当,量化后普通电脑就能跑,原生多模态,编程、Agent、多模态跑分表现出色。
AIGC开放社区
产品应用7
updream预演台:破解AI视频运镜难题
用AI做视频常遇运镜、人物走位等问题,因文生视频系统缺空间锚定能力。updream在8月17日上线「预演台」功能,通过传参考图自动生成3D白模场景,实测显示其显著减少「抽卡」次数。
新智元