谷歌Veo 3.1」共找到 3975 篇相关文章

产品应用7

本地部署Qwen 3.8 27B,要用什么配置

Qwen 3.8 27B是性能好、体积小的开源模型,个人也能本地部署。本地跑开源大模型,重点看容量和带宽两个指标,还介绍了Mac、RTX 5090、RTX PRO 6000三种部署方案及优缺点。

newtype AI
新闻资讯7

OpenAI将发布AI Agent浏览器,挑战谷歌Chrome

路透社消息,OpenAI将在未来几周发布AI Agent驱动的网络浏览器,或挑战谷歌Chrome。其设计让部分交互在聊天界面完成,还能整合产品自动执行任务,不过也面临激烈竞争。

AIGC开放社区
产品应用8

谷歌Gemini Diffusion:1500 token/秒,快如闪电!

谷歌DeepMind在I/O 2025上推出实验性模型Gemini Diffusion,将扩散技术用于文本生成。它每秒能生成约1500个token,比Gemini 2.0 Flash - Lite快5倍,具备高响应速度、文本连贯性等优势。

AGI Hunt
开源动态7

Meta 发布 Docusaurus 3.9,新增 AI 搜索功能

近日 Meta 发布 Docusaurus 3.9,重点更新有现代化运行时环境、增强 AI 搜索能力、提升国际化灵活性。如支持 DocSearch v4 让用户对话查内容,提高 Node.js 最低要求,改进 i18n 配置等。

InfoQ
产品应用8

谷歌Nano Banana全网刷屏,起底背后团队

谷歌开发者节目展示了Gemini 2.5 Flash Image模型,它能快速生成高质量图像、保持场景一致。文中起底背后团队成员,还介绍模型技术亮点、与Imagen对比及未来能力展望。

机器之心
算法论文8

Feed-Forward 3D综述:三维视觉如何「一步到位」

这篇由12所机构联合撰写的综述论文,总结2021 - 2025年间数百项创新工作,建立Feed - Forward 3D方法谱系与时间线,介绍五大技术分支、应用场景、评测指标与结果,还指出未来挑战与方向。

机器之心
开源动态7

蚂蚁开源MedResearcher-R1医学知识图谱+多跳推理

医学领域需处理复杂关系,现有医学AI系统缺乏对罕见实体和复杂关系的推理能力。MedResearcher - R1通过专门图谱和检索工具,结合两阶段训练范式解决问题,在医学基准测试取得新成果。

CourseAI
算法论文8

谷歌揭秘:Multi-Agent 推理时扩展才是未来。

谷歌DeepMind和MIT联合发表论文TUMIX,指出Multi - Agent是推理时扩展的最佳方式,以低成本大幅提升准确率。实验表明Agent多样性优于重复采样,还展示TUMIX机制、实战表现,且LLM能设计更强Agent。

探索AGI
新闻资讯8

Artificial Analysis 发布 2025 年 AI 现状 Q3 季报

Artificial Analysis发布2025年Q3 AI现状报告,揭示五大关键趋势,如推理模型占智能榜单前十、智能体能力突破、开源模型发布创新高、图像视频技术主流化、原生语音模型达生产级,还将举办简报会。

AGI Hunt
推荐文章7

图解Vllm V1系列6:KVCacheManager与PrefixCaching

文章聚焦vllm v1,阐述调度器取请求时判断设备有无充足空间做推理的问题,涉及KVCacheManager与Prefix Caching。前者管理请求和块,后者通过找最长一致前缀节省显存,还介绍块分配释放策略与流程。

GiantPandaLLM