Gemini 3.8」共找到 2780 篇相关文章

算法论文8

DeepMind率先提出CoF:视频模型有自己的思维链

DeepMind在Veo 3论文中提出帧链CoF概念,类比语言模型CoT,让视频模型能时空推理。实验显示Veo 3有通用视觉理解能力,能零样本解决视觉任务,未来通用视频模型或取代专用模型。

量子位
新闻资讯7

英伟达:祝贺谷歌TPU成功,但GPU领先一代

谷歌凭Nano Banana Pro、Gemini 3大获全胜,且Gemini 3用自研TPU。谷歌向客户推介TPU本地部署方案,欲抢占AI芯片算力市场。英伟达紧急发声强调自身核心地位,还砸钱拉拢大客户。

量子位
开源动态8

Qwen紧追OpenAI开源4B端侧大模型,AIME25得分超越Claude 4 Opus

Qwen团队深夜开源两个端侧模型Qwen3 - 4B - Instruct - 2507和Qwen3 - 4B - Thinking - 2507,尺寸对端侧友好,支持256k上下文。后者在AIME25测评得分超Claude 4 Opus,两模型能力较前作均有提升。

量子位
产品应用7

专治AI生图「人脸崩坏」,8倍速碾压GPT!新版FLUX.1多方位刷新SOTA

FLUX.1 Kontext是融合即时文本图像编辑与文本到图像生成的新一代模型,支持文本与图像提示,角色一致性强,速度快达GPT - Image - 1的8倍。它能解决AI生图“人脸崩坏”等问题,评估显示性能优异。

新智元
开源动态8

4.8K Star!一套面向设计工程师的 AI 编码智能体 UI 技能集合!

前端开发中AI生成代码质量参差不齐,ui - skills项目应运而生。它由开发者ibelick创建,是面向设计工程师的UI技能集合,将开发经验转化为规则,通过CLI工具让AI按规则构建和审查代码,已获4.8k Stars。

开源星探
开源动态8

如何做到在手机上实时跑3D真人数字人?MNN-TaoAvatar开源了!

阿里巴巴淘宝Meta技术团队研发的TaoAvatar技术,能在手机或XR设备实现3D数字人实时渲染与AI对话。今日开源MNN - TaoAvatar应用,可在手机运行,对比主流方案更高效便捷,还介绍其优势、技术及使用说明。

机器之心
新闻资讯7

人类秒懂,AI崩溃:一个简单测试,就让GPT-5、Gemini等顶级模型集体“翻车”

来自多机构研究团队发现,OpenAI的GPT-5等顶级AI模型,面对‘看得见但读不懂’文字时表现极差。VYU团队实验显示,人类能轻松读懂的切分拼接文字,AI却全军覆没,原因是其靠模式匹配,不懂文字结构。

量子位
新闻资讯7

AI到底会不会取代我们的工作?

作者分析2023 - 2025年10月近1.8亿份全球招聘启事,发现2025年总招聘岗位降8%。创意执行岗、基层员工岗位减少,而创意策略岗、高层领导岗位降幅小。客服、软件工程师岗位较坚挺,机器学习等岗位逆势增长。

宝玉AI
新闻资讯8

Nano Banana 拉爆谷歌营收创纪录,劈柴哥开心坏了!幕后团队曝内部“绝对优先事项清单”

谷歌CEO宣布单季营收破1000亿美元,Gemini月活达6.5亿。Nano Banana模型功不可没,其下载量飙升带动Gemini。幕后团队透露其诞生过程,还探讨AI对艺术创作影响、模型发展方向及未来迭代重点等。

AI前线
新闻资讯7

苹果春季新品奔着龙虾来了!AI性能暴涨8倍,8499元起

苹果发布MacBook Pro M5系列、MacBook Air M5笔记本,8499元起,还更新了显示器。新款MacBook Pro搭载M5 Pro和M5 Max芯片,AI性能大幅提升,提示词处理速度快4倍,图像生成速度快8倍,存储、续航等方面也有优化。

量子位