Gemini Deep Research」共找到 758 篇相关文章

新闻资讯7

IMO题库“过时”了!OpenAI内部模型挑战最新First Proof,做了7天错了一半

谷歌发布Gemini 3 Deep Think爆火后,OpenAI用未发布内部模型,一周内尝试解答10道来自数学家科研现场的真实问题,5道基本正确。这些题取自真实研究,切断模型“背答案”可能,意味着自主推理能力进化。

量子位
新闻资讯8

GPT-5今夏突袭?Sam Altman 首次大谈 GPT-5、AGI

OpenAI联合创始人兼CEO Sam Altman接受40分钟深度专访,谈到GPT - 5大概率今夏发布,也会因多种原因延期,还提及o3、Deep Research等产品对实现AGI的重要性,以及OpenAI其他创新产品、项目和发展规划等。

AIGC开放社区
产品应用8

Google 发布首个全模态 Embedding 2 模型,文本图片音视频 PDF 统一到一个向量空间

Google发布Gemini Embedding 2模型,它是业界首个原生支持文本、图片、视频、音频和PDF五种模态的Embedding模型,可将这些数据映射到同一向量空间,在多模态RAG、跨模态搜索等场景有应用,还介绍了跑分、用法、竞品、价格等情况。

AGI Hunt
新闻资讯7

谷歌卷土重来:你大爷还是你大爷

上周谷歌横扫科技媒体头条,传闻Meta考虑换谷歌TPU致英伟达市值蒸发,过去一月其缩水6000亿,谷歌涨5000亿。此前被看衰的谷歌,发布Gemini - 3及三季报后强势回归,TPU外供挑战英伟达地位。

远川科技评论
新闻资讯8

马斯克抢先谷歌一步放大招,Grok 4.1登顶LMArena,创意写作直逼GPT-5.1

当谷歌Gemini 3将上线消息传得沸沸扬扬时,马斯克xAI更快一步上线最新大模型Grok 4.1,响应速率提升、幻觉率下降。它有两个“形态”,免费开放且有APP版。在LMArena测试中成绩亮眼,多方面能力提升。

AI前线
开源动态8

牛!小米开源「音频语言模型」,超1亿小时预训练时间,音频理解和输出能力是真顶!

小米推出开源音频语言模型MiMo - Audio,有超1亿小时预训练时间。它能理解音频,70亿参数模型在多基准测试达SOTA,音频理解超Gemini - 2.5 - Flash,复杂推理优于GPT - 4o - Audio,还支持多模态任务。

开源AI项目落地
产品应用8

谷歌Nano Banana Pro炸了!硅谷AI半壁江山同框,网友:PS已死

谷歌推出基于Gemini 3 Pro的图像生成模型Nano Banana Pro,在图像编辑和生成上实现史诗级进化,有更广知识储备、超强文字渲染和精准细节把控。它支持4K原生,知识推理强还能直连搜索,玩法多样但也有改进空间。

新智元
新闻资讯7

谷歌卷土重来:你大爷还是你大爷

上周谷歌横扫科技媒体头条,英伟达官方X账号点赞谷歌TPU成绩后话锋一转称自家产品领先。此前有传闻Meta考虑换用谷歌TPU,消息致英伟达市值蒸发、谷歌市值上涨。今年谷歌发布Gemini - 3系列模型,其自研芯片TPU引发关注。

芯师爷
算法论文8

南大团队直击大模型高分神话:人类90分,最强模型仅49分

南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解新基准Video - MME - v2。它有创新的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。

新智元
产品应用7

Nano banana手办玩法火爆出圈!无需抽卡,效果惊了(°o°)

小某书被AI手办图刷屏,原来是谷歌的nano - banana(Gemini 2.5 Flash Image)模型爆火。文章实测其手办玩法,还介绍多种玩法,团队透露以文本渲染评估、原生多模态等核心技术,谷歌未来想整合模态实现AGI,还将举办黑客松。

量子位