「4D世界模型」共找到 8681 篇相关文章
SFT远不如RL?永不过时的剃刀原则打开「终身学习」大模型训练的大门
现代AI系统学习新任务时会灾难性遗忘旧知识,限制其持续学习能力。麻省理工学院研究者对比SFT和RL后发现,相同性能下RL更不易遗忘,提出遗忘定律,解释了RL优势源于其on - policy特性。
56岁在英国读博一:你看待世界的视角代表你内心盛开的花朵
英国Bristol大学胡老师分享56岁大叔博士答辩考核体验。大叔工作扎实、演讲强,年轻时因条件搁置读博梦,现子女毕业有积蓄便追梦。作者对此事有诸多感触,还提及AI学习市场。
AI大模型浪潮下的认知重构:从一个数据老兵的转型思考
作者作为数据老兵,分享接触 ChatGPT 后的转型思考。指出 AI 使编程、数据分析师岗位巨变,填鸭式教育不再适用。强调认知结构是护城河,还探讨了 ETL、数据建模及 AI 原生产品变化。
奇绩创坛 2025 春季路演:Agent、具身、Infra、AI4S,57 个项目完整介绍
奇绩创坛2025年春季创业营路演日,57家公司参与。项目集中在场景智能、空间/具身智能等方向,覆盖AI Agent、智能硬件等赛道,还展示了前沿科研和创业项目。文章介绍了各项目的一句话介绍、简介和团队情况。
4页绝密文件曝OpenAI野心!ChatGPT占领人类心智,25年致命杀招公开
法院文件揭露OpenAI战略,要让ChatGPT成年轻一代心中「最酷智能体」。2025年上半年将其升级为超级助手,下半年扩展功能。还剖析对手,计划构建护城河,加倍投入品牌。
纯靠“脑补”图像,大模型推理准确率狂飙80%丨剑桥谷歌新研究
剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。
3.4K星Apple出品FastVLM:视觉TTFT效率提升85倍,凭啥这么牛!
文章指出VLM在实际生产应用中因高分辨率图像存在效率问题,介绍Apple出品的FastVLM解决方案,阐述其架构、训练过程,展示在多个基准测试的性能,凸显在高分辨率输入下提升效率的优势及实际应用价值。
通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API
阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。
用AI把一段视频变成可视化网页,Google的新模型又卷飞了。
Google更新Gemini 2.5 Pro至05 - 06版。此版代码能力在WebDev Arena盲测登顶,超Claude 3.7 Sonnet;还提升视频理解,可将视频转为可视化网页,虽有产品打磨问题,但进步值得肯定。
成果三年两登Nature封面,这支清华团队想让AI换个方式看世界
清华大学类脑计算研究中心团队成果三年两登Nature封面。晰见科技承接天眸芯技术产业化,重新做AI的眼睛。天眸芯拆解视觉信息,构建互补通路,团队还研究算法融合信息,目前芯片进展良好。