「Gemini 3」共找到 2388 篇相关文章
GAIR 2025 世界模型分论坛:从通用感知到视频、物理世界模型的百家争鸣
第八届GAIR全球人工智能与机器人大会世界模型分论坛上,五位青年学者围绕世界模型展开精彩演讲,话题涵盖通用感知、三维技术等。他们的研究为世界模型领域带来不同启发,目前该领域研究尚处起步阶段,共识未形成。
多家芯片公司业绩飙涨,这个赛道彻底火了?
近期多家A股芯片公司Q3财报亮眼,受益于端侧AI推进。端侧AI优势多,吸引科技巨头布局,但落地有挑战。技术进步使大模型轻量化,手机与AI眼镜较热。其发展面临应用、技术、生态等问题,也有隐私保护方案。
小模型,大能量!200美金的GPT Pro竟然输给了它?
博主用11个场景深度测试昆仑万维的Skywork R1V4 - Lite,它能做到Gemini 2.5 Pro才能干的事,速度快、成本低。在定位、人物识别、生活实用、专业鉴定、学术研究等场景表现出色,核心突破在于主动图像操作与深度推理。
6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0
蚂蚁百灵大模型团队开源 MoE 大模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找到新平衡,为大模型‘参数膨胀’提供新路径,还在多领域应用表现出色。
新天终启,万象智生!从AlphaGo到GPT-5,新智元十年见证ASI创世纪
2025年9月7日新智元举办十周年峰会,主题为「新天终启,万象智生」,汇聚多位重量级嘉宾探讨AI前沿突破。当下AI发展迅猛,大模型密集发布,如OpenAI的GPT - 5、谷歌的Gemini 2.5等,中国造大模型也在开源领域领先。
Nano-Banana 核心团队分享:文字渲染能力才是图像模型的关键指标
谷歌新发布的图像生成与编辑模型Gemini 2.5 Flash Image(Nano - Banana)热度超Grok视频生成。文章通过团队访谈,介绍其图像创作新方式、文字渲染代理指标、交错生成能力等,还对比了与Imagen差异,展望AI终极形态。
整个硅谷被Meta 1亿美刀年薪砸懵了!Anthropic 联创正面硬刚:团队使命比黄金贵,多少钱都挖不动
Meta为抢AI人才,给出首年超1亿美元、四年封顶3亿美元的天价Offer。但Anthropic联合创始人Benjamin Mann称,团队重使命,钱难挖人。他还警示AI或重塑就业市场,约20%岗位受影响,同时分享AI安全等看法。
全球首次,Transformer「混血」速度狂飙65倍!英伟达已下注
康奈尔、CMU等机构研究者提出「混合体」Eso - LM,融合自回归和离散扩散模型范式。它引入KV缓存机制,推理速度相比标准MDM提升65倍,在速度与质量平衡上超越BD3 - LM,引发AI领域关注,英伟达或押注此方向。
Andrej Karpathy 盛赞!斯坦福团队新作,让Llama-1B 实现毫秒级推理
斯坦福Hazy Research团队将开源模型Llama - 3.2 - 1B前向推理整合为“Megakernel”,把推理延迟大幅降低,显存带宽利用率显著提升。团队指出当前主流LLM推理系统在小batch、极低延迟场景下低效,提出Megakernel以重构执行方式。
先进封装技术解读 | 三星
集成电路产业分芯片设计、制造、封装测试三大领域,先进封装让制造与封测融合。本文解读三星先进封装技术,分2.5D的I - Cube和3DIC的X - Cube,还与台积电、英特尔技术对比,指出三星多为跟随者。