连续思维机」共找到 534 篇相关文章

算法论文8

无需再训练即可增强性能!港大团队提出GPC框架,实现器人「策略组合」

器人学习领域,提升策略性能常需巨额成本。香港大学团队提出GPC框架,通过“策略组合”创造超越单一父策略的“组合策略”,免训练且跨架构、模态融合,经仿真和真实验验证性能提升。

机器之心
算法论文8

斯坦福英伟达推出测试时强化学习:微调开源模型胜过顶级闭源模型,仅需几百美元

斯坦福、英伟达等提出TTT - Discover方法,基于开源模型gpt - oss - 120b,在测试阶段引入强化学习更新模型权重。它采用熵目标函数和PUCT启发制,解决分布外问题,成本低且表现优,但目前适用于连续奖励场景。

量子位
新闻资讯8

陈天桥旗下AI公司MiroMind打造全球顶尖预测型大模型,性能登顶行业基准

全球首个动态实时LLM智能体未来预测基准FutureX推出,陈天桥旗下MiroMind团队连续两周蝉联冠军。其模型采用记忆驱动制,为预测与决策设计,还展现了在多领域的预测能力,且将开放相关框架和模型。

机器之心
新闻资讯8

GPT-6 Astra全面解析 - “欢迎来到AGI时代。”

GPT - 6 Astra在全球AI大宕后正式亮相,是全球最智能且最对齐的模型。它有诸多新特性,如操作电脑能力强、ARC - AGI - 3跑分高、审美提升等,但也带来思维链难监控等新问题。

数字生命卡兹克
算法论文8

DeepSeek比你更懂反思!谷歌重磅发现,智能的本质竟是一场社会化对话

谷歌等构研究发现,像DeepSeek - R1等推理模型思考复杂问题时,内部模拟多角色辩论赛,形成思维社会制,让AI准确率提升,证明智能本质或是内化社会互动,还为调优AI提供新方法。

AIGC开放社区
开源动态8

中科院联合清华等发布视觉语言行动推理模型VLA-R1,让器人先思考再行动

中科院自动化所、清华和GigaAI联合发布视觉 - 语言 - 行动模型VLA - R1,让器人先思考再行动。它通过构建数据集教模型思维链,结合监督微调与强化学习提升性能,经多场景测试表现出色。

AIGC开放社区
产品应用8

DeepRare 重磅发布:全球首个可循证智能体诊断系统,直击医学Last Exam难题

上海交通大学人工智能学院等联合发布全球首个罕见病推理型智能体诊断系统DeepRare。它结合大模型和多智能体架构,模拟医生诊断思维,支持多模态输入,在多数据集评估中表现出色,已上线在线平台。

机器之心
算法论文9

让具身智能体拥有「空间感」!清华、北航联合提出类脑空间认知框架,导航、推理、做早餐样样精通

清华、北航联合提出类脑空间认知框架 BSC-Nav,让具身智能体有「空间感」。它克服现有导航方法记忆难题,有三大记忆组件,实验中性能碾压,能应对复杂任务,真实测也表现出色。

机器之心
新闻资讯7

中国芯片就差一台EUV

中国芯片代工取得佳绩,全球前10大晶圆代工厂中大陆占3个。但与台积电差距大,核心在于缺EUV光刻。9位业内大佬联名呼吁造中国版ASML,国家也将推动产业链协同攻克此技术。

芯师爷
开源动态8

蚂蚁灵波开源LingBot-VLA后训练代码!150条示教数据即可适配新器人

蚂蚁集团旗下灵波科技全面开源具身基座模型LingBot-VLA的真后训练工具链,覆盖四个关键环节。模型基于2万小时真实器人数据预训练,仅需150条演示数据就能迁移任务,训练效率更高。代码库已在GitHub开源。

量子位