「大模型强化学习」共找到 8450 篇相关文章
八年研究沉淀,原方智能试图让机器拥有关于世界的「信念」
原方智能正式启动,由林浩鑫与唐开强创立,技术源于 LAMDA 团队八年研究。其目标是使机器在物理世界形成对世界的'信念',以世界模型为核心技术路线,将研究成果推向开放物理世界。
这个免费的任务助手登顶 SuperCLUE-XClaw 榜单
近日,SuperCLUE - XClaw发布最新测评榜单,百度文心助手在十个参评的国产龙虾产品中夺冠,获97.62分。SuperCLUE是关注中文大模型评测的第三方体系,其榜单受业内关注。文心助手还是免费的。
ICML 2026 | 北大提出的APEIRIA,打破了3D MLLM黑盒推理困境
北大团队提出面向3D空间推理的新框架APEIRIA,将神经符号程序推理模式蒸馏进3D MLLM。采用三阶段课程学习,在多基准测试表现强劲,保留模块化优势,为具身智能系统提供启发。
独家|地平线前高管牛建伟成立叮当动力,专注空间智能,获地平线领投数千万元投资
《AI科技评论》独家消息,前地平线智能座舱产品线总经理牛建伟创立叮当动力,专注空间大模型的通用具身智能,获地平线领投数千万元种子轮融资。牛建伟经验丰富,团队提出独特解决方案,产品聚焦多元场景。
搜索已死?被AI投毒搞怕了的我开始重新看待百度
作者辅导孩子背诗遇读音疑问,问AI结果更懵,百度则给出清晰准确答案且标注来源。原因在于AI基于大模型‘概率预测’易‘编答案’,百度用‘双层Agent’架构结合内容治理,答案更靠谱。
你的电子老婆开源了!登顶GitHub热榜
GitHub热榜项目AIRI是超火虚拟主播Neuro - sama的开源版,可自托管,7×24小时在线。它能实时语音、陪玩游戏等,支持多种大模型API,还介绍了不同系统搭建该项目的方法。
蚂蚁具身研究首次亮相!就解决了机器人「看」透明玻璃这些难题,还开源了
蚂蚁灵波科技开源高精度空间感知模型 LingBot-Depth,针对性解决机器人识别真实世界的「玻璃问题」。其构建双线并行数据集,提出掩码深度建模思路,在深度补全等任务中表现出色,且已具备落地能力。
辛顿高徒压轴,谷歌最新颠覆性论文:AGI不是神,只是「一家公司」!
2025年12月19日,谷歌DeepMind发布论文《分布式AGI安全》,提出AGI可能是“拼凑型”,由众多专才模型组成,在经济上更划算。还指出其存在风险,如默契合谋、责任消解等,并给出基于“防御纵深”原则的安全框架。
OpenAI 收购了自己的“甲方”公司
当地时间12月3日,OpenAI宣布收购Neptune.ai,该公司为企业提供AI模型训练跟踪工具,OpenAI本就是其客户。虽未披露财务条款,但报道称将以不到4亿美元股票支付,交易仍需满足成交条件。
通用的dLLM开发框架,让BERT掌握扩散式对话
扩散式语言模型(DLM)因缺乏易用框架和训练成本高受限。伯克利与UIUC团队基于dLLM框架,让BERT学会对话,证明‘离散扩散 + 轻量级指令微调’可赋予BERT强生成能力,还开源全流程代码。