Google I/O」共找到 788 篇相关文章

新闻资讯7

十分钟出结果,陶哲轩用Gemini Deepthink帮人类数学家完成Erdős问题论证

Erdős问题网站专注数学研究与解答,收录厄尔德什提出的各类数学问题。11月20日,Wouter van Doorn提出反例,陶哲轩提交给Gemini 2.5 Deep Think,十分钟得到证明,他半小时转为基础证明。之后Boris Alexeev用Harmonic的Aristotle工具完成形式化。

机器之心
开源动态8

IBM推出轻量多模态文档神器!OCR与QA超GPT-4o,识别率高达98%!

日常文档处理麻烦,现有工具或体积大、算力消耗高,或识别精度不够。IBM 开源轻量多模态文档处理模型 Granite - Docling,仅258M参数,性能超 GPT - 4o,适用于多场景。

开源星探
新闻资讯8

炸裂!谷歌I/O大会王者归来:Gemini“世界模型” 初现,搜索“换脑”,一句话制作原声电影

谷歌I/O 2025大会发布大量技术,虽Gemini 2.5 Ultra未到,但Pro有革新。还推出新模型、代理工具,多模态能力提升,搜索重塑,加入AI眼镜开发,倾尽全力发展AI生态。

AI寒武纪
开源动态8

OpenAI重新开源!深夜连发两个推理模型,o4-mini水平,笔记本、手机可跑

OpenAI 自 GPT - 2 后重新开源,此次连发两个推理模型 gpt - oss - 120b 和 gpt - oss - 20b。它们性能达 o4 - mini 水平,可在笔记本、手机运行,有宽松许可等亮点,在多测试中表现出色。

机器之心
开源动态7

开源要变天了,刚刚,OpenAI开源gpt-oss-20/120b,o4-mini水平,主打Agentic

OpenAI正式开源gpt-oss模型,Anthropic推出Claude Opus 4.1,Google DeepMind发布Genie 3。gpt-oss有20B和120B两个版本,前者可在边缘设备运行,后者综合能力强,在多方面表现出色。

PaperAgent
产品应用7

视频进入可编辑时代:藏师傅教你视频版 Banana 可灵 O1

可灵发布大一统视频、图像生成和编辑工具 O1,支持在一个界面完成视频图片编辑生成。此次更新统一多模态视频大模型,支持多模态输入,有诸多新特性,还支持自由选择视频生成时长和风格转换等。

歸藏的AI工具箱
开源动态7

凌晨,Qwen又更新了,3090就能跑,3B激活媲美GPT-4o

Qwen凌晨更新,Qwen3 - 30B - A3B有新版本Qwen3 - 30B - A3B - Instruct - 2507。仅激活3B参数,实力媲美谷歌Gemini 2.5 - Flash和OpenAI的GPT - 4o,在多项测试中提升显著,已在魔搭社区等平台开源。

机器之心
推荐文章7

深度解读|从 LLM WikiGoogle OKF,如何重建企业 Agent 的可靠知识底座

文章深入解读 LLM WikiGoogle OKF,探讨如何重建企业 Agent 可靠知识底座。指出 RAG 检索有局限,Wiki 式体系可整理知识。介绍 LLM Wiki 构想、OKF 规范及构建符合 OKF 约定的 LLM Wiki 的方法。

AI大模型应用实践
算法论文7

Google 新论文离谱到家了,0延迟0成本通用,提升大模型准确率最简单的方法。

Google新论文提出简单提升大模型准确率的方法,即重复提示词,把完全一致的输入连续发2次。主流模型适用,经70项benchmark测试,0场景效果倒退,47个场景准确率提升,且几乎不增延迟、成本。

探索AGI
新闻资讯8

Google 发了个压缩算法,内存砍 6 倍,速度快 8 倍,精度零损失

Google Research发布TurboQuant压缩算法,将在下月ICLR 2026正式发表。该算法把大模型的KV Cache压缩到3 bit,内存降6倍、速度快8倍且精度零损失,解决了传统算法的压缩开销问题。

AGI Hunt