谷歌I/O」共找到 1241 篇相关文章

产品应用7

实测可灵O1,AI视频界的Banana也来了。

可灵推出全新多模态视频大模型可灵O1,融合多种视频生成与修改能力。实测显示,它能实现视频内容增删、特定内容修改、扣绿幕、动作迁移、风格更改等功能,虽有局限,但开启用嘴改视频新时代。

数字生命卡兹克
新闻资讯8

训练数据量降低1万倍,谷歌提出超高质量数据主动学习方法

将大模型应用于特定领域需数据微调,但筛选高保真训练数据难度大、成本高。谷歌提出新主动学习筛选流程,能将训练数据规模降1万倍,还提升模型与人类专家一致性。经实验验证,该方法效果显著。

AIGC开放社区
产品应用8

谷歌nano banana正式上线:单图成本不到3毛钱,比OpenAI便宜95%

昨晚谷歌图像生成与编辑模型nano banana上线,正式名gemini - 2.5 - flash - image - preview。它有强大能力,成本低,有多种玩法,上线后测试火爆,在多个榜单成绩优异。

机器之心
新闻资讯8

AI的七窍打通了!谷歌发布Gemini Embedding 2原生多模态嵌入模型

谷歌发布Gemini Embedding 2新型基础架构,将文字、图像等数据整合到统一维度,终结旧工作流。该系统赋予机器五维感知,建立跨媒介沟通语言,提升运行效率,在多场景有应用潜力。

AIGC开放社区
新闻资讯7

谷歌开放世界模型一夜刷屏,AI游戏门槛归零时刻来了?

谷歌DeepMind开放世界模型Genie 3的实验性研究原型「Project Genie」,由Genie 3、Nano Banana Pro和Gemini提供技术支撑,有世界草绘、探索、重混三大玩法,但Genie 3仍处早期需改进。

机器之心
开源动态8

GPT-4o连验证码都解不了??SOTA模型成功率仅40%

MetaAgentX团队推出Open CaptchaWorld平台,用于测试Agent解验证码能力。实测SOTA多模态模型成功率低,如GPT - 4o也被难住。该平台特点多样,揭示了当前Agent短板及模型设计新方向。

量子位
新闻资讯8

谷歌Gemini杀入全球桶,血洗微软Office!颠覆全球3亿打工人

谷歌官宣Gemini全面升级版Workspace体验,全线接入Docs、Sheets、Slides。在SpreadsheetBench测试中成绩出色,谷歌Workspace更个性化实用。新功能覆盖文档、表格、幻灯片及云盘,还明确数据边界,欲定义下一代办公软件。

新智元
产品应用7

AI 互动游戏的 GPT 时刻到了!谷歌Genie 3首测!太牛了!

谷歌去年发布世界模型Genie 3,支持实时生成可交互视频内容,因成本高未开放。现美国18岁以上Ultra用户可试玩,其操控延迟低、画面清晰、物理交互真实,还介绍了操作流程等。

歸藏的AI工具箱
开源动态8

谷歌推出 LLM-Evalkit,为提示词工程带来秩序与可衡量性

谷歌推出基于 Vertex AI SDK 的开源框架 LLM - Evalkit,让大语言模型提示词工程更有序可衡量。它整合实验、测试等环节,与谷歌云工作流集成,有无代码界面,已在 GitHub 发布。

AI前线
产品应用8

Meta「轻量级」KernelLLM颠覆GPU内核生成,8B参数碾压GPT-4o

Meta推出基于Llama 3.1微调的8B参数KernelLLM,能将PyTorch代码转高效Triton GPU内核。实测单次推理性能超GPT - 4o和DeepSeek V3,多次生成得分更高,让内核开发更易上手。

新智元