「Google研究」共找到 2272 篇相关文章
为防AI刷题,Nature等顶刊最新封面被做成数据集,考验模型科学推理能力|上海交通大学
上海交通大学王德泉教授课题组提出MAC基准,用顶级期刊最新封面构建测试集,评测多模态大模型能力。研究设计两种含“语义陷阱”的测试任务,发现顶尖模型有局限,还提出DAD方法提升表现,采用双重动态机制。
从繁杂技巧到极简方案:ROLL团队带来RL4LLM新实践
当前RL4LLM领域发展快但存在标准、结论不一及机制解释不足等问题。阿里巴巴淘天集团和爱橙科技联合高校基于ROLL框架研究,评估关键技术组件,提出简化算法Lite PPO,在多基准上表现佳。
新世界首富:斥巨资求永生,TikTok收购案最可能买家,得OpenAI千亿订单
81岁的拉里·埃里森上周凭借OpenAI千亿订单成新世界首富。他创立甲骨文,怼大佬、爱极限运动、捐钱研究永生。甲骨文与OpenAI签五年3000亿美元合同,股价一度飙升,他还可能买TikTok,儿子想并购好莱坞巨头。
扎克伯格看OpenAI直播挖人,北大校友孙之清加入Meta
本周五,前OpenAI研究科学家Hyung Won Chung晒照,显示他、孙之清与Jason Wei已加入Meta新成立的超级智能实验室。孙之清曾是ChatGPT Agent核心开发者,还和山姆・奥特曼直播发布该产品,一个月后跳槽。
【翻译】在 Codex 中使用 Goals:长时间工作的持久目标
文章介绍 Codex 中的 Goals,它是持久目标,能让线程跨多轮对话朝明确结果推进。阐述了 Goals 与普通 prompts 的区别、编写方法、活跃后的变化、设计方式及适用场景等,还通过案例展示其在研究任务中的应用。
真正的一句话修图:Gemini 用香蕉模型给出了图像生成的分水岭
Google新模型Gemini 2.5 Flash Image可在AI Studio体验。它有多图融合、角色一致性等能力,能实现自然语言编辑图像,速度快、价格低、API可用,虽有中文体验等问题,但有望让AI视觉工具进入工程化时代。
硅谷AI巨头越来越像一家重工业公司
Meta和CBRE推出LevelUp光纤技术员培训项目,为数据中心培养新手。此外,Google、Amazon、Microsoft也有类似职业教育项目。同时,这些超大规模云服务商还在电力、硬件、连接等方面自建自用,呈现垂直一体化趋势,但资本市场仍按软件公司给它们估值。
总成本降低30倍,告别昂贵后训练,在线策略蒸馏敲开大模型后训练的未来
明星公司Thinking Machines由前OpenAI首席技术官联合创立,其研究团队提出在线策略蒸馏的LLM后训练方法。该方法结合在线策略训练与蒸馏优势,解决后训练两难困境,成本降30倍,还为持续学习和个性化打开新大门。
LLM 语境下,「持续学习」是否是 「记忆」 问题的最优解?
本期通讯解读 3 个 AI 业内要事,包括谷歌嵌套学习范式引争议、AI 产品记忆方向探讨、英伟达合成数据等。谷歌 NL 范式想规避遗忘问题,测试中 HOPE 表现优,但也遭质疑,当前 LLM 研究更关注改善记忆。
GPT-5超越人类医生!推理能力比专家高出24%,理解力强29%
最新研究显示,GPT - 5在医疗领域处理多模态信息能力出色,在多模态测试中推理和理解得分比GPT - 4o分别提高近30%和36%,比人类医生还高。其能力提升源于端到端多模态架构,但现实应用还需更多实战考验。