「Gemini - 2.5」共找到 3570 篇相关文章
马斯克Grok 4.6重回一梯队!更低价格反超Fable 5,这Cursor是真没白收购
马斯克携Grok 4.6让SpaceXAI重回大模型牌桌。它跑分超GPT - 5.6 Sol和Fable 5 Max,价格更低。此次升级聚焦长程agent任务,还发布了Grok Bot智能体,后续Grok 4.7也将登场。
刚刚,ChatGPT免费模型升级了:幻觉砍半/记忆更强/回答更简洁
ChatGPT默认模型升级为GPT - 5.5 Instant,免费用户可用。它幻觉减少52.5%,新增“记忆来源”,答案更简洁,语气更温暖自然。从5月5日起向所有用户滚动上线,替代GPT - 5.3 Instant。
Canva可画联合创始人独家专访:2.65亿用户的Canva,用自研模型,解决了设计的审美问题
Canva月活2.65亿,在a16z排名第三。4月16日开启Canva AI 2.0内测。联合创始人Cameron Adams称,自研模型结合14年数据是护城河,Magic Layers功能验证其价值。Canva要成用户进入AI入口,还会在中国持续投入。
眼馋苹果刚发布的液态玻璃效果?藏师傅教你提示词一键实现
苹果 WWDC2025 发布的液态玻璃效果引关注,虽卡片中心可读性差,但预计会被广泛使用。藏师傅探索出将其融入网页生成的提示词,介绍了在不同模型上的效果及提示词内容和使用注意事项。
谷歌让机器人「长脑子」了!首发离线具身VLA模型,断网精准操控
谷歌首发具身智离线模型Gemini Robotics On-Device,实现VLA多模态大模型在具身机器人本地离线运行,无网络也能稳定运行。谷歌还开源了SDK,具身智能迈向实用化新阶段。
突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度
在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。
Nano Banana 邪修之王最强科研成果!教你自定义生图比例!
Nano Banana 出图有分辨率低和比例不可控问题。作者发现用垫图方式可控制其生图比例,已生成图片也适用,还给出操作方法、提示词,介绍不同平台效果及案例图下载方式。
谷歌太壕了!编程Agent大招至简:开源且免费,百万上下文、多模态、MCP全支持
谷歌开源免费的编程Agent Gemini CLI,提供业界最高免费限额,能在终端访问Gemini。其能力多样,涵盖代码理解等,支持百万上下文、多模态和MCP,开源协议为Apache 2.0,还给出安装和使用指引。
半世纪难题48小时破解!陶哲轩组队把AI数学玩成打怪游戏了
陶哲轩与多名数学家合作,借助多种AI工具,仅用48小时就解决了尘封50年的Erdős问题。此次解题既有“人与人的协作”,也有“人与AI的协作”,这种方式正成新趋势。
AI看不懂的色盲测试背后,藏着一场像素与诗意的战争。
作者和同事测试AI色盲测试图,多模态模型Gemini 3 Pro、Claude Opus 4.5等纷纷答错,仅GPT 5.2 Thinking答对且靠代码作弊。研究发现,AI看图断章取义,缺乏人类的“格式塔”能力。