Gemini Omni Flash」共找到 743 篇相关文章

新闻资讯8

云栖大会阿里掀桌子了!Qwen3-Max、VL、Omini、Agent ... 统统发布!

云栖大会上,阿里云智能首席技术官介绍千问多款新模型发布及一款升级。如万亿参数的Qwen3 - Max,代码和Agent能力强;还有Qwen3 - Coder - Plus、Qwen3 - VL、Qwen3 - Omni、Qwen3 - LiveTranslate等模型各有亮点。

探索AGI
新闻资讯7

谷歌卷土重来:你大爷还是你大爷

上周谷歌横扫科技媒体头条,英伟达官方X账号点赞谷歌TPU成绩后话锋一转称自家产品领先。此前有传闻Meta考虑换用谷歌TPU,消息致英伟达市值蒸发、谷歌市值上涨。今年谷歌发布Gemini - 3系列模型,其自研芯片TPU引发关注。

芯师爷
新闻资讯8

AI圈“集体开大”!DeepSeek、Claude带头,智谱、阿里、蚂蚁、智源都“卷”起来了

双节前最后一天,AI圈“卷”疯了!智谱发布并开源GLM - 4.6,是国内最强Coding模型;阿里介绍视、听、说全模态同传大模型Qwen3 - LiveTranslate - Flash;蚂蚁开源万亿参数推理大模型Ring - 1T - preview;智源开源跨本体基座大模型RoboBrain - X0。

AI科技大本营
算法论文8

南大团队直击大模型高分神话:人类90分,最强模型仅49分

南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。

新智元
新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,如Qwen3-Max对标顶尖模型,Wan2.5支持音画同出,Qwen3-VL开源且跑分出色,Qwen3-Omni是全模态模型等。发布会上阿里股票涨飞,其构建了全模态、全场景超级生态。

数字生命卡兹克
新闻资讯7

谷歌最强大模型付费上线,在DeepSeek开源后被吐槽太贵

谷歌最强模型Gemini 3 Deep Think上线,推理能力强,能将草图变3D场景、搭建游戏。它在多评测基准表现出色,准确率超GPT - 5 Pro等。但仅向Ultra会员开放,月费约1800元,被吐槽贵,开源的DeepSeek-V3.2成冲击因素。

量子位
算法论文8

ICLR 2026|原生多模态推理新范式ThinkMorph ,让文字与图像在统一架构中共同演化

NUS、ZJU 等联合提出「ThinkMorph」,主张文字与图像在统一架构「原生协作」。仅用 2.4 万条数据微调 7B 统一模型,视觉推理平均提升 34.74%,多项任务比肩或超 GPT - 4o 和 Gemini 2.5 Flash,还涌现新能力。

机器之心
开源动态8

消费级显卡可以快速上手跑!面壁智能MiniCPM-o 4.5发技术报告

面壁智能联合多方发布MiniCPM-o 4.5技术报告。该模型是业界首个端到端全双工全模态大模型,参数约9B,依托Omni - Flow框架,多项性能对标前沿大模型,还推出多种使用方式,兼顾普通用户与开发者需求。

量子位
产品应用7

我用Cursor测了下GPT-5.2,好像并不是那么回事儿~

GPT-5.2发布,奥特曼称其很强。作者用Cursor在真实Coding场景对GPT-5.2和Gemini 3 pro做测试,涉及烟花盛宴、5000篇Paper分析、RAG代码重构,结果显示GPT-5.2在多方面表现欠佳,写代码需慎重。

PaperAgent
开源动态7

不可思议!400B大模型在iPhone上跑起来了

一个跑在 iPhone 17 Pro 的 A19 Pro 芯片上的 400B 大模型 Qwen3.5 - 397B - A17B 引发关注。这源于 Flash - MoE 开源项目,它摒弃现代 AI 框架,回归底层开发,实现消费级硬件上大模型交互级速度运行。

机器之心