预训练数据」共找到 4009 篇相关文章

推荐文章8

商汤林达华万字长文回答AGI:4层破壁,3大挑战

在WAIC 2025上,商汤发布国内首个实现“图文交错思维”的商业级大模型日日新6.5。商汤科技联合创始人林达华发文,剖析多模态通用智能实践,解答AI领域关键问题,提供通往AGI的参考。

量子位
算法论文8

北大、蚂蚁三个维度解构高效隐私保护机器学习:前沿进展+发展方向

北大李萌课题组与蚂蚁集团研究者共同完成综述,从协议、模型和系统三个维度梳理隐私保护机器学习(PPML)领域,指出当前痛点,给出优化策略,还提出跨层级协同优化方向。

机器之心
新闻资讯8

震撼,世界模型第一次超真实地模拟了真实世界:谷歌Genie 3昨晚抢了OpenAI风头

昨晚谷歌DeepMind宣布Genie世界模型到第3代,能通过单个文本提示词创建交互式、可玩环境。它在多方面优于前代及其他模型,具备构建完整世界能力,但也存在动作空间有限等局限,未来应用值得期待。

机器之心
新闻资讯7

奥特曼首晒GPT-5实测!被曝使用超级对齐团队“遗产”

奥特曼首晒GPT - 5实测,虽对话仅围绕电视剧推荐,但引发大量关注。除官方放料,还被曝重写编码规则,用上超级对齐团队“遗产”通用验证器,不过也有爆料称其研发遇困难。

量子位
推荐文章7

OpenAI分享了一份上下文工程实用指南。

OpenAI产品负责人Miquel联合Piotr发布Context Engineering深度指南。介绍了Context Engineering概念、6种核心上下文,指出RAG只是其中一环,还讲述信息检索的多种范式及上下文组装方法。

探索AGI
推荐文章7

一起聊聊Nvidia Blackwell新特性之低比特GEMM

本文是NVIDIA Blackwell架构GEMM研究系列文章第三部分,介绍低精度计算,探讨Blackwell GEMM如何执行,关注6位和4位格式及对内存布局影响。还提及低精度优势、数据格式、UMMA实现、操作限制、CUTLASS抽象方式等。

GiantPandaLLM
新闻资讯7

95后北大校友挑起ChatGPT Agent大梁!今年刚博士毕业,曾获陶哲轩支持的AIMO第二名

OpenAI发布ChatGPT Agent项目,奥特曼重视有加,让两个华人挑大梁。孙之清从技术介绍强化学习训练,Casey Chu谈人类与Agent合作。孙之清是95后北大校友,Casey Chu领导过GPT - 4视觉输入原型开发。

量子位
开源动态8

全球最强开源「定理证明器」出世!十位华人核心,8B暴击671B DeepSeek

八大顶尖机构推出开源定理证明器Goedel - Prover - V2,有32B和8B两版本。它在多个基准测试击败671B的DeepSeek - Prover,采用创新技术,以少算力刷爆SOTA,十位华人是核心贡献者。

新智元
开源动态8

揭秘 GitHub 11.1k 让你的存储秒变“万能盘”?JuiceFS:最好用的存储系统能为你带来怎样革命性的提升?

云存储成本高、性能差等问题让人烦恼,JuiceFS 可零代码改造,将对象存储升级为高速共享文件系统。它功能丰富、架构有优势,代码示例简单,适用于多场景,相比竞品优势明显。

小华同学ai
新闻资讯8

机器人顶会RSS 2025奖项公布!大牛Pieter Abbeel领衔研究获杰出Demo奖

机器人顶会 RSS 2025 于 6 月 21 - 25 日在美国洛杉矶举行,公布多个奖项。如杰出 Demo 奖论文提出 MuJoCo Playground 开源机器人学习框架,简化全流程,可分钟级训练策略。

机器之心