新闻资讯7
谷歌推Gemini 3新能力,或应战DeepSeek
新智元
AI 摘要
Google DeepMind为Gemini 3 Flash推Agentic Vision,让模型主动处理图像,性能提升。此能力已上线,谷歌还将拓展。可能受DeepSeek-OCR2刺激,两者技术路线不同,争夺视觉AI定义权。
阅读原文 · 新智元
Gemini 3「开眼」像素级操控!谷歌回应DeepSeek-OCR2
Google DeepMind为Gemini 3 Flash推出Agentic Vision,让模型主动编代码操控图像,性能提升5% - 10%。该能力已上线,谷歌还计划扩展功能。这或许是受DeepSeek-OCR2刺激,两者技术路线不同。

关注公众号
扫码关注
第一时间收到每日精选
相关文章
新闻资讯7
GPT-5.6 Sol视觉能力跃升,性价比战刚开场
第三方评测机构Roboflow测试显示,GPT-5.6 Sol在目标检测、计数等视觉任务上表现出色,尤其在文档版面识别和密集场景处理上进步明显,但认字能力有退步,且大尺寸图片检测框易飘移。
新智元
新闻资讯8
OpenAI等用AI攻克Erdős数学难题
2026年,OpenAI等公司用AI解决多个匈牙利数学家Paul Erdős提出的问题,震动数学界。这些问题分布广、难度跨度大,适合模型测试。不过,AI证明的验证和人类数学家地位受关注。
机器之心
产品应用7
RabbitVis:引领视觉AI进入创作流程
随着AI生图能力提升,如何让AI进入创作流程成新问题。兔展智能基于UniWorld - Design视觉AI大模型推出RabbitVis,推动视觉AI从图片生成走向可编辑、可交付的创作流程,解决创作流程断点问题。
机器之心
新闻资讯8
谷歌AI一夜破9道56年数学难题
Google DeepMind发布全新AI数学智能体AlphaProof Nexus,一次性攻克9道悬而未决几十年的Erdős开放问题,最老的已悬置56年。证明经Lean编译器验证,无错误可能。此外,还在多数学分支取得突破。
新智元