「谷歌搜索」共找到 1247 篇相关文章
开源项目 | 用自然语言做视频剪辑,人人都能用的 AI 视频剪辑工具
FireRed - OpenStoryline是开源AI视频剪辑智能体,理念是‘你说话,它剪片’。工作流程为‘理解→执行→输出’。具备智能素材搜索、文案生成等多项能力,适用于多场景,介绍了安装方式、优缺点。
GPT-5.4 发布,OpenClaw的能力要被取代?OpenAI 新模型不仅会自己用电脑,编程能力也拉满了
今天 GPT-5.4 发布,整合推理、编程及原生计算机使用能力。其原生电脑操作能力提升,与 OpenClaw 竞争。还带来工具搜索降成本、减少幻觉,编程能力增强但价格也升级。
“光顾赚钱不搞研究”,OpenAI元老级高管出现离职潮,Mark Chen紧急回应
OpenAI现元老级高管离职潮,如研究副总裁Jerry Tworek等。《金融时报》称与战略转向有关,Mark Chen反驳。内部因专注LLM撕裂,缺算力致资源集中ChatGPT,OpenAI危机四伏。
顶级商战往往采用最朴素的方式:你叫「微软」,我叫「巨硬」
2026决战前夜,AI成抢夺电力与地皮的「物理战争」。谷歌要5年内算力拉升1000倍,抠能效;马斯克自建电厂、买仓库,手搓算力中心,还在名字上挑衅微软,不过也引发环保抗议。
NVIDIA开源“Banana”级黑科技!会懂物理、理解时间的图像编辑模型!
继谷歌Banana后,英伟达开源物理级图像编辑模型ChronoEdit - 14B,被称‘NVIDIA版的Banana’。它有‘时间观念’和‘物理常识’,能按描述生成符合物理规律图像,适用于多领域。
社区供稿 | 开源SOTA:阶跃发布端到端语音大模型Step-Audio 2 mini!
阶跃星辰发布最强开源端到端语音大模型 Step - Audio 2 mini,在多个国际基准测试集获 SOTA 成绩。它统一建模语音理解等,率先支持语音原生 Tool Calling 能力,架构创新,案例展示其多方面强大能力。
三大云厂同时瘫了?Cursor、ChatGPT跟着倒下!网友:整个互联网都要废了
北京时间昨天晚上,AWS、谷歌云、Azure和Cloudflare同一时间发生中断,谷歌云服务全球瘫痪3小时,导致旗下及第三方多服务受影响。Spotify、Cloudflare也受波及,引发对宕机原因及云厂商依赖的讨论。
AI加持的开源知识库新秀:PandaWiki,如何用它打造智能化文档系统?
PandaWiki 是长亭科技开发的 AI 大模型驱动的开源知识库搭建系统,能助力用户快速构建智能化文档系统。它有 AI 创作、问答、搜索等功能,安装简单,适用于多场景,优势明显。
只用图像也能思考,强化学习造就推理模型新范式!复杂场景规划能力Max
现有 MLLM 依赖文本处理视觉信息,会造成信息丢失。剑桥、伦敦大学学院、谷歌团队提出视觉规划范式,以强化学习框架 VPRL 提升模型规划能力,实验显示其性能优于文本规划。
赛博义父Tibo最新访谈:专门实体按钮搞重置,“我想重置就重置”
赛博义父Tibo在播客中透露诸多OpenAI内幕,如ChatGPT和Codex将融合成个人化AGI,下一代Agent核心是机制“消失”等,还回顾谷歌经历,分享OpenAI文化、产品发展等观点。