自我训练」共找到 2392 篇相关文章

算法论文8

LeCun发布最新世界模型:首次实现16秒连贯场景预测,具身智能掌握第一视角!还打脸用了VAE

LeCun团队推出PEVA模型,让具身智能体学会人类“预判能力”,首次实现16秒连贯场景预测。它结合结构化动作表示与条件扩散Transformer,用真实数据训练,解决长时序问题,还能筛选最优动作。

量子位
算法论文8

AI一眼认出95万物种,还能分辨雄雌老幼,2亿生物图像炼成“生命视觉”大模型

俄亥俄州立大学团队用2亿生物图像训练BioCLIP 2模型,取得最优物种识别性能。它在无相应监督信号的非物种任务中,准确率远超DINOv2,还涌现出物种间生态对齐、物种内差异分离等生物学理解。

量子位
新闻资讯7

机器人搬冰箱成了!洗碗之后又一痛点,网友:解放我的髋关节

波士顿动力最新人形机器人Atlas能搬动几十公斤重冰箱。它定位为干重活,动作模拟人类搬重物,训练靠强化学习,经参考轨迹、奖励函数、仿真训练、真机测试迭代。

量子位
开源动态7

宇树:开源机器人世界大模型!

宇树开源世界模型 - 动作架构UnifoLM - WMA - 0,它属UnifoLM系列,适配多机器人本体。真机部署表现出色,预测与实际操作吻合。官方介绍训练策略,代码开源后GitHub获100 + Star。

量子位
开源动态7

静态技能已死:cognee怎么让AI自己修自己的prompt

文章指出当前agent技能存在silent drift问题,Cognee作为开源知识引擎,将skills视为活的系统组件,通过Skill Ingestion、Observe、Inspect、Amend、Evaluate & Update五步实现自我进化,还介绍了相关应用及社区反应。

AI工程化
开源动态8

不用千亿参数也能合成高质量数据!这个开源框架让小模型“组团逆袭”,7B性能直追72B

上海人工智能实验室与中国人民大学提出GRA框架,以“多人协作”理念让小模型分工生成高质量训练数据。实验显示其生成数据质量高,项目已开源。它打破对大模型蒸馏依赖,展现“集体智能”潜力。

量子位
开源动态8

世界模型一口气输出小时级视频不跑偏,开源了

Alaya Lab等联合推出的Alaya - EVOKE能生成小时级视频,解决常见问题。它把记忆搬到模型外,改造教师模型,经多轮技术操作,实验成绩佳,给出清晰训练方案,也指出项目边界。

量子位
算法论文7

700多个「坏模型」喂出AI测谎仪?Anthropic审计神器让AI自曝黑料

Anthropic故意训练近700个「有问题」模型,训了LoRA适配器(IA)让模型自报家门。IA在AuditBench平均成功率59%,但也存在幻觉、成本高、训练分布无指南等局限。

新智元
算法论文8

「重要性采样」并不「重要」?快手清华ASPO攻克重要性采样权重错配

快手与清华合作团队发现大语言模型结果监督强化学习中,重要性采样机制“失灵”,存在权重错配现象。为此提出算法ASPO,在多基准测试中展现优势,训练更稳定。

量子位
开源动态7

装完Hermes Agent玩了一圈,我觉得龙虾已死!

Hermes Agent势头正猛,被视为龙虾以来首个真正的竞争对手。它让Agent自己做Harness Engineering,自己写、用、改Skill,还能自我迭代。文章介绍了安装使用方法,对比了与其他项目的差异。

探索AGI