Gemini 3.0」共找到 3048 篇相关文章

开源动态8

首个MCP架构、只50行代码就能实现高效RAG的开源框架UltraRAG 2.0

检索增强生成系统(RAG)复杂度提升,使科研人员面临高昂工程实现成本。清华大学、东北大学、OpenBMB等联合推出UltraRAG 2.0,基于MCP架构,降低技术门槛与学习成本,让科研专注创新。

PaperAgent
产品应用7

人生教练团Agent v2.0!给你省下万元咨询费(内有详细教程)

作者打造“人生教练Agent 2.0”,将马斯克、查理·芒格等大神“塞进”电脑。它有AI主持人,能根据问题召集合适导师。还介绍使用流程,灵感源于AIasMe等,后续会教加记忆功能。

AI 产品自由
开源动态8

OpenAI未公开的o3「用图思考」技术,被小红书、西安交大尝试实现了

OpenAI推出的o3推理模型打破传统文字思维链边界,实现图像融入推理过程。小红书与西安交大联合构建多模态深度思考模型DeepEyes,尝试实现类似能力,还开源技术细节,在多任务中表现出色。

机器之心
产品应用8

谷歌认领最强AI版Photoshop!现在人人可用,效果确实强悍

谷歌认领神秘图像编辑模型nano - banana,即Gemini 2.5 Flash Image。它可免费在Gemini和Google AI Studio使用,API收费。该模型图像编辑能力出色,能合并图片、实现2D到3D转换等,此前爆火却无官方文档。

量子位
开源动态8

Qwen3家族训练秘籍公开:思考/非思考融进一个模型,大模型蒸馏带动小模型

Qwen3技术报告揭晓8款模型关键技术,采用双模式架构,训练和微调分段进行,还“大带小”蒸馏数据。其融合思考与非思考模式,训练分多阶段,Qwen Chat还全量上线深度研究功能。

量子位
算法论文8

字节Seed提出M3-Agent:像我们一样"记住"与"思考"的长视频理解新范式

字节Seed提出M3 - Agent,这是首个融合实时视听输入、类人记忆构建与自主推理的多模态智能体。它模仿人类记忆机制,解决长视频理解痛点,已被CVPR 2025收录并开源代码,为通用人工智能奠定基础。

深度学习自然语言处理
算法论文8

突破显存瓶颈:基于 DeepSeek-V3.2-Exp 的 Latent Cache 卸载预取方案设计与模拟验证

百度百舸AIAK团队针对DeepSeek-V3.2-Exp,设计基于Latent Cache的卸载预取方案ESS。该方案解决显存瓶颈,提升Decode吞吐并降低成本,经模拟验证效果显著,未来将拓展应用。

InfoQ
新闻资讯8

这个世界越来越科幻了:OpenAI 发布 AI 超级助理 Plus,Gemini 发布有了真正的“思考力” 的机器人

OpenAI发布ChatGPT Pulse,它基于个人信息主动分析兴趣、梳理日程,预测需求并推送资讯或建议,像懂心思的私人助理。谷歌DeepMind推出Gemini Robotics 1.5,让机器人有自主‘思考’能力,其ER 1.5模型预览版上线。

宝玉AI
新闻资讯8

刚刚,Gemini 2.5系列模型更新,最新轻量版Flash-Lite竟能实时编写操作系统

谷歌更新Gemini 2.5系列模型,包括2.5 Pro和Flash稳定版及新推出的Flash-Lite预览版。谷歌CEO称Flash-Lite性价比高,适用于量大且注重成本的任务。报告还提及“智能体恐慌”现象。

机器之心
算法论文8

谢赛宁团队新基准让LLM集体自闭,DeepSeek R1、Gemini 2.5 Pro都是零分

纽约大学等8家机构研究者提出LiveCodeBench Pro竞技编程基准测试,评估了Gemini 2.5 Pro等前沿大模型。发现当前模型有显著不足,在无外部工具时,高难度题通过率为0,LLM与人类大师级水平差距明显。

机器之心