「互补学习系统理论」共找到 2935 篇相关文章
OpenAI去年挖的坑填上了!奖励模型首现Scaling Law,1.8B给70B巨兽上了一课
全新奖励模型「POLAR」采用对比学习范式,摆脱对海量人工标注依赖,有强大Scaling潜力。它衡量训练与目标策略「距离」作奖励信号,用自动化合成数据预训练,小模型能超越大数十倍规模对手。
灵初智能陈源培:一个 00 后的机器人之梦
00 后陈源培是灵初智能联创,本科土木工程专业,大二因比赛对机器人感兴趣。他研究灵巧手,参与开源项目,灵初发布相关模型。他认为强化学习对灵巧手重要,还谈了模型、创业、落地等看法。
具身智能的Skill时刻!英伟达开源机器人技能库,Jim Fan:范式变了
英伟达开源能让机器人持续成长的技能库ASPIRE,类似机器人版Coding Agent,会沉淀机器人操作经验。英伟达机器人主管Jim Fan称其代表全新持续学习范式,论文实验验证其效果好于此前方法。
全国大学生,苦 AIGC 检测久矣
央视报道,多位高校学生毕业论文被 AIGC 检测系统误判,甚至《滕王阁序》《出师表》也被标为高风险。检测原理主要依赖「AI 困惑度」和「突发性」。毕业季检测算法升级致结果大幅波动,引发学生不满。
12小时登顶OpenAI MLE-bench!上海AI Lab开源算法进化框架MLEvolve
上海AI实验室开源算法进化框架MLEvolve,12小时登顶OpenAI MLE - bench榜单第一。它是自进化机器学习系统,在75道Kaggle竞赛题上奖牌率达61.33%,为AI自主算法设计提供新方案。
GPT-5爆改时尚圈,让Excel原地复活!OpenAI黑客松大奖出炉
OpenAI举办GPT - 5黑客马拉松挑战赛,95支队伍角逐5万美元奖金。韩国Gentoo团队夺冠,其用GPT - 5开发系统助力商家营销。此外,还有团队将GPT - 5用于时尚、电子表格、知识学习、电脑使用、电网决策等场景。
RAG2.0进入“即插即用”时代!清华YAML+MCP让复杂RAG秒变“乐高”
检索增强生成系统(RAG)复杂度提升,开发者面临高昂工程成本。基于MCP架构的UltraRAG 2.0框架,让科研人员用YAML文件声明复杂逻辑,降低技术门槛与学习成本,还提升了复杂多跳问题性能。
阿里开源创新AI Agent:媲美Deep Research,Github每日增长第一
人类信息检索能力受限,OpenAI的Deep Research虽能解决难题但闭源。阿里巴巴通义实验室开源AI Agent框架WebSailor,在多基准测试表现出色,核心技术围绕复杂任务生成和强化学习模块展开,在Github成绩亮眼。
刚刚,Figure 03人形机器人登场,能感知一枚回形针重量
Figure 03是初创公司Figure发布的第三代人形机器人,能做家务、胜任服务类工作,指尖可感知3克力。它配备新传感器和手部系统,为家庭设计,实现无线自主运行,也为量产和商业应用做了诸多优化。
中学生就能看懂:从零开始理解LLM内部原理【九】| 层归一化:神经网络的稳定器
本文是系列文章第九篇,介绍了神经网络中的层归一化。先回顾标准差、标准分概念,指出其可使差异可控稳定。接着说明层归一化将原思想用在神经网络,还加入可学习参数,最后总结其作用与应用位置。