「谷歌Gemini」共找到 1202 篇相关文章
利用大模型检测钓鱼邮件:方法,效果及数据集
随着企业安全防范增强,钓鱼邮件成重要攻击手段,大模型检测方法盛行。日本论文详细披露检测方法和实验数据,含解析解码、简化邮件、生成prompt、调用LLM四步,还介绍数据集及评估了四个模型效果。
御三家格局松动:Google和Meta同日发布新模型,第三名不再稳了?
2026年9月2日,Google推出Gemini 3.8 Flash,Meta发布Muse Spark 1.3。此前Google经历人事调整、旗舰延期,靠Flash维持节奏;Meta则重建团队、收窄战略。二者产品定位相似,各有优劣。
“光顾赚钱不搞研究”,OpenAI元老级高管出现离职潮,Mark Chen紧急回应
OpenAI现元老级高管离职潮,如研究副总裁Jerry Tworek等。《金融时报》称与战略转向有关,Mark Chen反驳。内部因专注LLM撕裂,缺算力致资源集中ChatGPT,OpenAI危机四伏。
有手就行,教你从0到1快速手搓搭建个GUI Agent
随着通用大模型发展,搭建GUI Agent难度降低。文章介绍如何用通用大模型API,从0到1搭建PC GUI Agent,包括原理、代码实现等,该Agent能跨应用操作,未来可强化功能。
顶级商战往往采用最朴素的方式:你叫「微软」,我叫「巨硬」
2026决战前夜,AI成抢夺电力与地皮的「物理战争」。谷歌要5年内算力拉升1000倍,抠能效;马斯克自建电厂、买仓库,手搓算力中心,还在名字上挑衅微软,不过也引发环保抗议。
实时语音翻译
Sokuji 是跨平台桌面应用,用 OpenAI、Google Gemini 等 API 提供实时语音翻译。支持多系统,有桌面版和浏览器插件,适配会议场景,还具备音频可视化、虚拟音频设备等特色功能。
NVIDIA开源“Banana”级黑科技!会懂物理、理解时间的图像编辑模型!
继谷歌Banana后,英伟达开源物理级图像编辑模型ChronoEdit - 14B,被称‘NVIDIA版的Banana’。它有‘时间观念’和‘物理常识’,能按描述生成符合物理规律图像,适用于多领域。
三大云厂同时瘫了?Cursor、ChatGPT跟着倒下!网友:整个互联网都要废了
北京时间昨天晚上,AWS、谷歌云、Azure和Cloudflare同一时间发生中断,谷歌云服务全球瘫痪3小时,导致旗下及第三方多服务受影响。Spotify、Cloudflare也受波及,引发对宕机原因及云厂商依赖的讨论。
只用图像也能思考,强化学习造就推理模型新范式!复杂场景规划能力Max
现有 MLLM 依赖文本处理视觉信息,会造成信息丢失。剑桥、伦敦大学学院、谷歌团队提出视觉规划范式,以强化学习框架 VPRL 提升模型规划能力,实验显示其性能优于文本规划。
赛博义父Tibo最新访谈:专门实体按钮搞重置,“我想重置就重置”
赛博义父Tibo在播客中透露诸多OpenAI内幕,如ChatGPT和Codex将融合成个人化AGI,下一代Agent核心是机制“消失”等,还回顾谷歌经历,分享OpenAI文化、产品发展等观点。