「泛化推理能力」共找到 4677 篇相关文章
Ilya重磅发声:Scaling时代终结!自曝不再感受AGI
Ilya在与主持人Dwarkesh Patel的深度访谈中爆出惊人观点,认为Scaling时代已终结,我们正走向研究时代。他指出当前技术路线后劲不足,模型泛化能力远逊人类,还探讨了AI发展的诸多关键问题。
西湖大学于开丞创业做概念世界模型,过亿元融资后首次公开发声
2023 年于开丞做世界模型无人看好,如今该领域大热。他曾否定自己成功工作,提出“概念世界模型”解决泛化问题。其创办的西湖数智已融资超 1 亿,还分享了技术路线及对行业的看法。
说句话,造个3D世界!腾讯VibeWorlding氛围造世界
香港科技大学(广州)和腾讯团队开源VibeWorlding框架,实现说句话造3D世界。它由VWE - Bench和VibeWorlding - Gym组成,开源模型经强化学习训练后成绩逆袭,证明强化学习解锁3D推理潜力巨大。
SpaceX为何官宣收购xAI?8万亿太空炼丹梦,别无脑跟进!
2026 年 2 月 3 日,马斯克宣布 SpaceX 全资收购 xAI。直接原因是 SpaceX 盈利而 xAI 烧钱,合并为解决资金问题;根本原因是 Grok 竞争失利,想借 SpaceX 运载能力打造太空算力形成差异。但太空训练面临散热等难题,推理可行。
SGLang Model Gateway 0.2 发布:企业级一体化AI原生编排
市面上一体化AI原生编排方案稀缺,Oracle和SGLang团队推出SGLang Model Gateway 0.2。它从SGL - Router重构而来,核心能力升级,架构分三层,部署灵活,还支持Kubernetes集成和向后兼容。
GPT-Image-2平替!最强开源生图模型来了
OpenAI推出GPT Image 2引发AI生图大战,国内厂商商汤反击,推出多模态理解生成模型SenseNova U1并全面开源。它通过自研架构实现理解、推理、生成统一,实测表现惊艳,能力全维度,与GPT-Image-2范式不同。
IMO题库“过时”了!OpenAI内部模型挑战最新First Proof,做了7天错了一半
谷歌发布Gemini 3 Deep Think爆火后,OpenAI用未发布内部模型,一周内尝试解答10道来自数学家科研现场的真实问题,5道基本正确。这些题取自真实研究,切断模型“背答案”可能,意味着自主推理能力进化。
500行极简开源框架,硬刚GPT/Gemini视觉极限!
多模态大模型代码能力进步大,但基础视觉任务常失误。UniPat AI构建SWE-Vision框架,让模型用代码处理视觉判断,在五个视觉基准测试达最优,其极简设计有效且泛化性强,代码已开源。
具身智能一步踏入Scaling Law!10B+基础模型,27万小时真实数据
AI机器人创业公司Generalist推出新型具身基础模型GEN-0,参数量10B+,专为多模态训练构建。该模型展现强大Scaling Law,能力可扩展,有和谐推理等特性,在多方面有突破,成果备受赞誉。
三大核心创新公开,快手开源多模态Keye-VL 1.5拿下视频理解SOTA,8B力压GPT-4o!
快手开源多模态Keye-VL 1.5,为8B视频理解大模型,公开3大核心创新技术。靠Slow - Fast视频编码等,在20 + 基准屠榜。它能精确视频定位,实验显示通用、视频理解和数学推理表现佳。