Gemini 2.0 LLMs」共找到 2864 篇相关文章

开源动态8

突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度

在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。

量子位
新闻资讯7

The Batch: 870 | 手机上的主动式AI助手

谷歌发布Pixel 10,搭载Magic Cue AI系统。它基于新版Gemini Nano,运行在Tensor G5处理器上,能预判用户需求,自动提供相关信息。谷歌早就在手机推AI,此次将其深度融入系统和应用。

DeeplearningAI
产品应用8

亿万打工人在用的WPS,未来可能要重塑你的工作流

WAIC上,金山办公发布WPS AI 3.0及原生Office办公智能体WPS灵犀。WPS知识库解决文档管理难题,WPS灵犀功能全面,能深入办公场景,还推动AI办公向Agentic Software演进。

量子位
新闻资讯8

AI助手现在认路了:谷歌地图直接「长」进大脑

谷歌DeepMind为Gemini API更新,带来三大核心变化:内置工具和自定义函数可在同一次调用混用;新的「上下文环流」技术解决多步骤工作流丢上下文问题;Google Maps原生接入Gemini 3。这让Agent开发走向「工业化」。

新智元
产品应用7

AI版Chrome终于来了

Google正式推出Gemini in Chrome功能,将Gemini整合进Chrome浏览器。Chrome从‘内容展示器’变为‘内容理解器’,有多标签页处理等功能,提升效率,还推动浏览器形态演进,未来或能替用户操作。

newtype AI
产品应用7

Nano Banana 邪修之王最强科研成果!教你自定义生图比例!

Nano Banana 出图有分辨率低和比例不可控问题。作者发现用垫图方式可控制其生图比例,已生成图片也适用,还给出操作方法、提示词,介绍不同平台效果及案例图下载方式。

歸藏的AI工具箱
8

DeepMind夺得IMO官方「唯一」金牌,却成为OpenAI大型社死现场

谷歌DeepMind宣布其Gemini进阶版模型在IMO竞赛达金牌水平,解决五道超高难度试题,首次证明AI仅靠自然语言理解就能攻克复杂数学难题。其谨慎发布方式获赞誉,与OpenAI形成鲜明对比。

机器之心
产品应用7

Google 推出超小杯 AI:Gemma 3 270M!可进手机和浏览器

Google发布Gemma 3家族最小版本Gemma 3 270M,2.7亿参数,能耗低,在同规模模型中表现突出。设计理念是“够用就行”,适合特定任务,已在多平台发布,开源策略效果好。

AI工程化
产品应用8

刚刚,MiniMax新模型接管「音乐圈」!20秒出歌Cover全风格

4月10日,MiniMax带来重磅更新,上线Music 2.6模型并发布专属Music Skills,核心新功能Cover翻唱可自由进行风格置换。Music 2.6在速度、音乐性和音质上改进明显,还开放三个Music Skills套件。

机器之心
产品应用8

谷歌机器人大脑又进化了。成功率飙3倍,还能看表干活、保护自己

Google DeepMind发布机器人大脑Gemini Robotics ER 1.6模型,提升机器人空间感知、多视角解析与仪表读取准度,具精准指认、读表能力,还提高操作安全性与合规度,开发者可通过Gemini API等使用。

AIGC开放社区