「手部重定向算法」共找到 794 篇相关文章
中科大校友,谷歌量子处理器总监 Yu Chen 揭秘Willow量子芯片背后的“秘诀”
谷歌量子AI团队宣布“Willow”量子芯片运行“量子回声”算法,实现可验证量子优势。中科大校友、谷歌量子处理器总监Yu Chen揭秘其“秘诀”,芯片关键性能指标高,让算法运行速度提升13000倍,谷歌正迈向量子计算路线图“里程碑3”。
OpenAI官宣:重组完成!非营利基金会手握1300亿美金股权,专注两大领域
OpenAI董事会主席Bret Taylor宣布公司完成资本重组,非营利的OpenAI基金会手握约1300亿美元股权,控制营利性业务。基金会初期250亿美元聚焦健康与疾病治疗、AI韧性技术方案。今晚Sam将直播答疑。
LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制
中国科学院自动化研究所、腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。
LLM内部竟藏着众多策略模型?自所&腾讯团队首次揭示大模型RL新机制
中国科学院自动化研究所与腾讯AI Lab团队从可解释性分析出发,发现LLM内部含多个可采样内部策略,揭示不同模型推理熵模式,提出BuPO算法,在复杂推理任务上性能显著优于传统算法。
NeurIPS 25 | 中大&UC Merced等开源RAPID Hand,重新定义多指灵巧手数据采集
来自多机构研究者联合提出全新开源高自由度灵巧手平台 RAPID Hand。它能解决硬件瓶颈问题,实现稳定、高质量数据采集。其软硬协同优化,在操作表现与稳定性上优于现有方法,还具备低成本等优势。
8块钱跑通一次强化学习全流程,潞晨云重塑微调赛道:1名算法工程师=1支Infra团队
大模型下半场,后训练特别是强化学习成核心战场。潞晨云微调SDK上线,它是国内首个全面开放、且兼容Tinker范式的Serverless微调平台,为强化学习提供低成本解法,在易用性和成本上有优势。
AAAI2025、POF | 西湖大学冯浩东、范迪夏等:如何在不准确物理信息和部分观测下利用物理信息建模流体力学系统
此文章聚焦在不准确物理信息和部分观测下利用物理信息建模流体力学系统问题。提出RPLPO与PIPO算法,前者解决部分观测模型泛化性,后者解决不准确物理信息在部分观测中的应用,实验验证了算法有效性。
Figure人形机器人首秀灵巧手叠衣服!神经网络架构不变,只增加数据集就搞定
Figure人形机器人首秀用灵巧手叠衣服,在未改变神经网络架构、仅增加数据的情况下,让原本用于物流场景的它习得新技能,完成了端到端的操作,还实现自然多模态交互。
AI本该助力新人,为何反而让高手更强?
人们曾认为AI能让初级程序员创造高质量代码,减少对高级工程师依赖。但现实是‘高手 + AI’才是有效组合。文章分析AI优劣,指出其让高手更强,还给出使用建议,强调要校准对AI的期待。
告别「利用率崩溃」:GIPO开启大模型强化学习高效训练新方法 | ICML 2026
树根科技与三一集团团队联合提出 GIPO 算法,在机器人操控及大语言/视觉动作模型强化学习训练中,缓解了策略滞后痛点,改善了 PPO 硬截断引发的‘利用率崩溃’问题。介绍了 GIPO 算法原理、优势及实验结果。