Gemini 3.2」共找到 3719 篇相关文章

算法论文8

开放世界任务成功率82%!美的攻克机器人泛化控制难题

美的AI研究院和华东师范大学联合提出ChatVLA - 2模型,引入动态混合专家架构和双阶段训练流程。真机实验显示其开放世界任务成功率达82%,远超现有方法,为通用机器人控制提供新思路。

量子位
新闻资讯7

他给谷歌做出了最火CLI工具,结果被开了

谷歌老兵Poehnelt做的Google Workspace CLI工具获2.8万星,因仓库用谷歌Logo被开除,谷歌随后推出官方版。同时,谷歌人才出走严重,两天走两个诺奖级人物,Gemini核心开发者也跳槽,致股价大跌。

量子位
新闻资讯8

刚刚,全球视频模型新王诞生了!

天工AI的SkyReels-V4直接登顶Artificial Analysis文转视频全球榜,超越Veo 3.1、Sora 2。其相比之前有两大核心升级,让视频生成从‘生成片段’走向完整视频生产,还应用于短剧平台DramaWave。

量子位
开源动态8

从多模态大模型中「拆」出音频向量模型

Google 发布原生多模态向量模型 Gemini Embedding 2,推动 Omni Embedding 发展。Jina AI 团队分享从多模态大模型中「拆」出音频向量模型的经验,介绍架构、训练数据,对比四种做法,还提及评测、应用场景及结论。

Jina AI
新闻资讯8

梁文锋,Nature全球年度十大科学人物!

权威科学期刊《自然》公布2025年度十大科学人物榜单,梁文锋因DeepSeek模型对AI领域的重要贡献与变革性影响成功当选。此外,中国研究员杜梦然也因相关研究入选,还有多位其他领域人物因各自成就上榜。

量子位
产品应用8

关于 AI Agent,「实在」、「好用」可能比「颠覆」更重要

8月18日百度AI Day上,百度文库、网盘联合发布全端通用Agent「GenFlow2.0」。它无需邀请码,多专家协助,能利用文库和网盘数据,实测在多场景表现超预期,稳定高效,“好用”才是关键。

刘言飞语
推荐文章8

构建会“说话”和“行动”的 AI:生成式数字人技术与 EchoMimic 实践

在 QCon 全球软件开发大会上,支付宝李宇明围绕 EchoMimic 介绍生成式数字人进展、技术、应用及研究思路。对比传统数字人,生成式数字人成本低、易控制,但也有技术新、推理成本高的问题。EchoMimic 两版本已开源,经优化推理速度可提升。

InfoQ
新闻资讯7

Anthropic CEO:人的幻觉比AI 更多!这是真的吗?

Anthropic公司CEO称AI幻觉比人类少,创业公司ColdIQ联合创始人Alex Vacca用虚构故事喂给ChatGPT、Claude和Gemini,测试它们识破谎言的能力,实验结果显示各模型表现不同,AI幻觉短期内难消失。

AGI Hunt
新闻资讯8

雷峰网现场直击:ICRA 2026下周在维也纳开幕,中国力量站上C位

6月1日,IEEE国际机器人与自动化会议(ICRA 2026)将在维也纳开幕。今年投稿量4947篇破纪录,86个国家参与,1882篇论文被录用。热门方向有VLA模型、Sim - to - Real、3D感知,中国研究者从投稿大国迈向规则定义者。

AI科技评论
开源动态8

单Agent时代正式结束:一个干不过,就上300个

月之暗面发布并开源 Kimi K2.6 模型,热度高。它强化 Agent 团队协作能力,核心能力进步,领先对手。在编程领域发力,长程编码能力突破,集群协同输出强,还适配框架,实测效果出色,Claw 群组开启内测。

机器之心