Gemini 3.5 Pro」共找到 3803 篇相关文章

开源动态8

世界模型有了开源基座Emu3.5!拿下多模态SOTA,性能超越Nano Banana

北京智源人工智能研究院的悟界·Emu3.5是最新最强的开源原生多模态世界模型,能处理图、文、视频任务,在多项权威基准上性能亮眼,还具备理解长时序等能力,背后有技术创新,且选择开源。

量子位
开源动态8

3B Image Captioning小钢炮重磅来袭,性能比肩Qwen2.5-VL-72B

文章推荐Dense Image Captioning新技术CapRL,它首次将DeepSeek - R1强化学习法用于image captioning,创新定义reward。训练的CapRL - 3B模型性能比肩Qwen2.5 - VL - 72B,解决了reward设计难题,已开源相关内容。

机器之心
新闻资讯7

谷歌Gemini 3.0「全家桶」年度压轴,前端不再需要人类!下周王者降临

网友爆料谷歌下一代旗舰模型Gemini 3.0将于10月22日发布。不少开发者拿到内测资格并放出demo,显示其在前端开发表现惊人,能一键直出网页、游戏等,还能原创音乐,或对前端和设计产生较大影响。

新智元
新闻资讯7

Gemini 3 上线两周,ChatGPT 日活下降 6%,Altman 内部信拉响红色警报

2025年12月初,AI领域权力转换,Google新一代多模态模型Gemini 3挑战ChatGPT。自其发布两周,OpenAI日活降6%。Sam Altman发内部信拉响警报,要求聚焦提升ChatGPT核心体验。

MacTalk
新闻资讯8

GPT-5≈o3.1!OpenAI首次详解思考机制:RL+预训练才是AGI正道

OpenAI研究副总裁Jerry Tworek在播客访谈中称,GPT-5类似o3.1。他详解模型推理过程,强调RL+预训练是AGI正道,肯定DeepSeek的GRPO算法,还分享自身经历及OpenAI工作结构。

量子位
新闻资讯7

这个扩散LLM太快了!没有「请稍后」,实测倍速于Gemini 2.5 Flash

AI初创公司Inception Labs推出首款专为聊天定制的商业级扩散LLM——Mercury。它速度超快、效率高,能实时响应对话。实测显示其速度优于Gemini 2.5 Flash等,不过生成质量有待提升。

机器之心
产品应用8

史诗级痛点修复!GPT-5.3 Instant 突发上线:写作,语气,准确度全面升级

ChatGPT目前使用率最高的模型GPT-5.3 Instant正式上线,核心优化用户日常交互体验,解决此前反馈强烈的痛点,如削减拒答与说教、让对话更自然、优化联网搜索等,还降低幻觉率,提升写作辅助能力。

AI寒武纪
新闻资讯8

巅峰对决:最强模型GPT-5.3-Codex与Claude Opus 4.6同时发布

OpenAI和Anthropic同时发布旗舰级模型GPT - 5.3 - Codex与Claude Opus 4.6。前者有网络攻防与自主代码修复能力,被评定为网络安全高风险;后者用自适应思考与上下文压缩处理长程任务,在多领域表现出色,但二者也都存在安全风险。

AIGC开放社区
新闻资讯8

智源悟界·Emu3.5发布,开启“下一个状态预测”!王仲远:或开启第三个 Scaling 范式

2025年智源发布悟界·Emu3.5,在“Next-Token Prediction”基础上实现“Next-State Prediction”。它能力全面提升,或开启第三个Scaling范式,还在预训练、强化学习、推理加速上有技术创新。

AI前线
开源动态8

谷歌王炸开源编程 Agent:Gemini 2.5 Pro 塞进命令行,每天1000 次免费调用,重新定义 CLI 开发体验

谷歌正式开源 AI 编程智能体 Gemini CLI,它是全能终端 Copilot,免费且开源,免费额度高,不止编程,还原生集成。能满足开发者在 CLI 中对集成式 AI 辅助的需求,带来全新开发体验。

chaofa用代码打点酱油