训练数据污染」共找到 3919 篇相关文章

新闻资讯7

Databricks收购Mooncake,Lakebase想给AI应用换个“心”

Databricks收购Mooncake Labs,旨在推进为AI智能体优化的新型OLTP数据库Lakebase。它基于Postgres,想让数据直接用于工作负载,省去ETL流程,简化AI应用后端数据架构设计。

AI工程化
新闻资讯7

突发!卡帕西宣布入职Anthropic

大神Karpathy宣布加入Anthropic,重回一线大厂。他曾多次在AI领域转换角色,此次将加入预训练团队,开展用Claude加速自身预训练研究。外界揣测其离开OpenAI原因,加入Anthropic能为研究提供更多资源。

量子位
新闻资讯8

机器狗腿被锯了也能继续走!最新机器人大脑来自320亿估值独角兽

Skild AI推出Skild Brain机器人大脑,它在虚拟环境训练相当于一千年时间成型。此模型没在对应机器人训练,控制能力是涌现的,能应对肢体断裂、马达卡住等情况,还可完成精细动作。

量子位
新闻资讯8

Meta华人新秀毕树超,重磅爆料下一代LLM路线!RL+预训练直通AGI

OpenAI前研究员、Meta成员毕树超在哥大演讲指出,AGI需高质数据、好奇驱动探索与高效算法,Scaling Law有效,规模决定智能,终身学习是重点,还探讨了AGI面临的诸多问题与挑战。

新智元
算法论文8

强化学习的进化:从PPO到MaxRL,LLM推理训练的算法演进史

本文概述2024 - 2026年推理LLM的强化学习进展,从REINFORCE和PPO讲起,介绍GRPO、RLOO等多种算法。指出critic模型非必需,标准差归一化有副作用,损失聚合很关键,信任域是优化切入点,还提出几个未解决的挑战。

机器之心
算法论文8

VLM剪枝新SOTA:无需重训练,注意力去偏置超越6大主流方案

常用的attention机制存在位置偏置和padding异常,影响剪枝效果。上海大学曾丹团队提出无需重新训练的attention去偏方法,在多模型、剪枝策略及基准上验证有效,为多模态模型部署提供新思路。

新智元
推荐文章7

GAN之父Ian Goodfellow病后归来,剑指高效世界模型

GAN之父Ian Goodfellow等提出,利用符号化表示和游戏虚拟世界数据,或为构建动作条件多模态世界模型最佳路径,该模型可支持长时序任务预测与规划,还探讨构建原因、数据来源等。

机器之心
新闻资讯8

π0.7发布,VLA押出了机器人的GPT-3时刻

今天凌晨,Physical Intelligence发布VLA模型π0.7,首次在机器人领域证明组合泛化。它用多样化prompt处理多样数据,涌现多种能力,还证明数据过滤可能是伪问题,架构基于前作,推动VLA回归。

量子位
开源动态7

数据优势发挥到极致:「杭州六小龙」开源搭建空间智能的第一步

大模型时代数据支撑至关重要。群核科技在首届TechDay为空间智能发布空间语言模型SpatialLM 1.5和空间生成模型SpatialGen,前者学会空间语言,后者实现场景多视角图像生成且具时空一致性,SpatialGen已开源。

机器之心
产品应用8

OceanBase湖库一体,重新定义AI数据

AI时代数据库面临变革,使用者从人类应用扩展到Agent,管理的数据和承载的工作负载也发生变化。OceanBase坚持一体化设计,发布湖库一体的AI数据库,解决AI生产系统的数据基础设施问题。

量子位