有监督学习」共找到 7102 篇相关文章

算法论文8

模仿学习新范式!Chain-of-Action:轨迹自回归实现动作推理

具身智能领域尚未迎来「GPT时刻」,现模仿学习范式缺陷。字节跳动与阿德莱德大学研究者提出「动作链」(CoA)策略,通过轨迹自回归建模解决累计误差,提升泛化性,实验效果显著。

机器之心
开源动态8

社区供稿 | Index-AniSora 技术升级开源: 动漫视频生成强化学习

B站升级动画视频生成模型Index - AniSora技术并开源,支持多种二次元风格视频镜头一键生成。基于相关研究提出首个专为二次元视频生成的强化学习技术框架,构建奖励数据集、训练AnimeReward、提出GAPO优化策略,实验验证其效性。

Hugging Face
开源动态7

OpenMAIC:一键生成互动课堂,视频+PPT全都,还可以编辑

清华开源项目OpenMAIC是多智能体互动课堂,上传文档或描述主题,几分钟就能生成虚拟课堂,AI教授讲课、同学讨论,还白板功能。底层用LangGraph编排,支持主流模型,OpenClaw集成,架构完整。

AI工程化
算法论文8

DeepMind 颠覆机器人学习范式:让机器像人一样 “自由成长”

谷歌DeepMind受大模型微调中强化学习阶段启发,提出面向机器人学的两阶段后训练方法,含监督微调与自我提升。实验显示该方法让机器人自主习得新技能、广泛泛化,但研究也存在标注成本高等局限。

AI科技评论
算法论文8

让思考更准更长!强化学习新算法FIPO来了

阿里通义实验室Qwen Pilot团队发布系列博客剖析大模型强化学习机制与局限,推出新算法FIPO。该算法引入Future - KL机制,解决‘推理长度停滞’问题,在多项测试表现优异,还介绍招聘信息。

千问大模型
算法论文7

60个量子比特顶百万倍内存:量子机器学习找到新的突破口

4月8日,加州理工学院等联合团队在arXiv发布论文,证明小型量子计算机处理部分机器学习任务时,可用指数级更少内存超越经典计算机。研究绕开QRAM,提出算法框架验证优势,但仍待真实硬件验证。

DeepTech深科技
新闻资讯7

失去三个联创后,Mira公司危机持续:又两人要出走

前OpenAI CTO Mira Murati创办的Thinking Machines Lab危机不断,此前三位联创离开,如今又两位技术骨干将出走,多家媒体称是OpenAI人才突袭,公司内部产品、发展等分歧或是主因。

机器之心
产品应用8

每天上线一个新系统,这款腾讯自用低代码什么不同

腾讯自用低代码平台无极,平均每天上线1.2个新系统,用户覆盖1/3员工。它去模板化,从数据结构设计开始,数据推导UI,灵活编辑器,支持渐进式开发,具备集成性和开放性,还AI赋能。

腾讯技术工程
新闻资讯7

LSTM之父向何恺明开炮:我学生才是残差学习奠基人

LSTM之父Jürgen Schmidhuber替学生Sepp Hochreiter发声,称残差学习30年前已诞生,1991年Sepp就用循环残差连接解决梯度消失问题,为残差思想奠基。他觉得将成果全归何恺明团队失偏颇。

量子位
产品应用7

数据库厂商入局AI又新思路,OceanBase选择“卖铲子”

国产数据库厂商 OceanBase 入局 AI 新思路,近期动作频频。其云数据库业务 OB Cloud 实现 AI 能力开发部署并与多平台集成,已在多行业落地。副总裁尹博学谈其 AI 战略逻辑、面临挑战及未来趋势等。

InfoQ