RL 优化技术」共找到 4017 篇相关文章

开源动态8

首个多模态工业信号基座模型FISHER,权重已开源,来自清华&上交等

清华、上交等团队联合发布首个多模态工业信号基座模型 FISHER,用搭积木法对异质工业信号统一建模。技术报告和权重已开源,还提出 RMIS 基准评估性能,实验显示其泛化能力强。

机器之心
开源动态8

碾压DeepSeek V3!阿里开源新版Qwen-3,屠榜级断层第一

今天凌晨1点,阿里巴巴开源Qwen3系列新版本Qwen3 - 235B - A22B - 2507。它是非思维推理的指令微调模型,性能强劲,在多类测试基准中大幅超DeepSeek开源的新版V3 - 0324及月之暗面的kimi - k2。

AIGC开放社区
8

驭浪而行,产业向新:2025世界人工智能大会智能体论坛前瞻,共探AI产业变革|甲子光年

2025年7月28日9点,在世界人工智能大会期间,“驭浪而行 产业向新——智能体驱动产业变革论坛”将在上海世博中心举行。论坛由多方联合主办,通过三大版块探讨AI智能体产业落地痛点,有领导致辞、院士报告等多个看点。

甲子光年
产品应用7

别卷Agent了!这两款“AI算姻缘”App,靠收割美国人的孤独,狂赚200万美金!

当大厂为AGI、Agent烧钱时,“AI算姻缘”App Starla和Astra 20天狂赚超200万美金。它们以“GPT对话+AI生图+星盘概念”抓住人们对“灵魂伴侣”的渴望,靠低技术策略获高收益。

探索AGI
产品应用7

小哥硬核手搓AI桌宠!接入GPT-4o,听得懂人话还能互动,方案可复现

国外小哥Matthieu Le Cauchois受皮克斯台灯机器人启发,手搓AI桌宠Shoggoth,接入GPT - 4o,能与人互动。它结构简单可复现,采用低级和高级控制层,策略经仿真和真实环境验证有效。

量子位
推荐文章8

小白也能看懂,一文彻底说清 MCP、A2A与AG-UI,大模型应用集成协议三件套。

文章面向有一定技术基础但不熟悉大模型应用开发的读者,通俗介绍MCP、A2A和AG - UI三大主流集成协议,分别解决不同的集成难题,三者构成大模型应用集成完整生态。

AI大模型应用实践
新闻资讯7

机器人“梅西”的养成:干活之前,得先学踢足球

文章讲述人类驯化机器人踢足球的历程,从早期探索到如今技术发展,涉及比赛设置演变、技术难点攻克、团队配合提升等,还探讨了机器人踢球能力迁移及赛事商业前景,展望2050年机器人足球队目标。

AI科技评论
算法论文8

强化学习也遇到了“天花板”?Andrej Karpathy构建了一个新算法

大神Karpathy肯定强化学习(RL)价值,指出其比监督微调更具扩展性,但存在渐进式学习低效、背离人类学习机制的局限。他提出“第二天性”新范式算法,还面临泛化等挑战。

AI寒武纪
开源动态8

还在为AI数据发愁?张文涛和鄂维南院士团队推出Data-centric AI系统

近年来大模型发展由科技公司主导,其数据资源不公开,学术界构建优化数据难。张文涛和鄂维南院士团队推出DataFlow系统,可实现数据治理,有算子和流水线,支持文本模态,多模态版待推出。

机器之心
新闻资讯8

VLA爆发!从美国RT-2到中国FiS-VLA,机器人「即知即行」的终极进化

2025年具身智能爆火,VLA模型成核心。从美国RT - 2到中国FiS - VLA,VLA硬核进化。谷歌、微软等有重要成果,中国智平方等企业也不断创新,FiS - VLA性能超现有方法,VLA正重塑机器人与人类交互未来。

新智元