AI强化学习」共找到 10383 篇相关文章

产品应用8

审美在线、随叫随到、月薪19刀——Lovart把AI设计师这件事做认真了

Lovart适合无设计预算的人,将专业设计师装进AI工具。其Brand Kit解决风格不稳定问题,Font Generator可生成专属字体,Create Skill能固化学习成本,还有Export PSD、Mock Up等实用功能,月费仅19美元。

AI寒武纪
算法论文8

深度视角 | 物理法则如何“纠偏”AI黑盒?首篇社会物理学引导的深度学习(SGDL)综述深度解析

近日,清华等多机构发布全球首篇SGDL系统性综述。文章介绍SGDL诞生背景、核心架构、应用场景,探讨其与大模型结合潜力,也指出面临的挑战,认为其是思维范式跃迁,正构建智能社会蓝图。

AI科技评论
推荐文章8

退隐3年后回归,周末写的AI一夜刷屏、一周拿下10万Star增速超Linux,Clawdbot之父首次长谈:如今几乎不看自己发布的代码

本文是对OpenClaw开发者Peter Steinberger的深度专访。他曾打造PSPDFKit,隐退三年后回归,用大模型工具开发出OpenClaw。他分享了开发历程、工作方式,探讨AI对编程的影响,还指出大公司采用AI的难点及对开发者的建议。

AI科技大本营
新闻资讯8

OpenAI 直播摘要:AI 将推动科学进步,个人 AGI 即将到来,未来将非常光明

OpenAI 直播中,Sam Altman 和 Jakub Pachocki 透露重磅信息,称个人 AGI 即将到来,未来光明。公布通向超级智能时间表,对深度学习有信心,谈及基础设施扩张、公司架构变化等,还预测科学发现进程。

AGI Hunt
算法论文8

LLM工业级自进化:北邮与腾讯AI Lab提出MoE-CL架构,解决大模型持续学习核心痛点

北邮百家AI团队与腾讯AILab提出MoE - CL架构用于LLM自进化持续指令微调。其结合‘解耦LoRA专家’与‘GAN对抗降噪’,在腾讯业务及基准测试中效果佳,降低人工成本,准确率优于主流方法。

机器之心
算法论文8

AlphaGo作者领衔,8个机械臂协同干活0碰撞,DeepMind新作登Science子刊

DeepMind等机构成果RoboBallet登Science子刊。它将图神经网络用于强化学习,可控制8个机械臂协同无碰撞工作。核心是结合图神经网络与强化学习,解决多机器人协作复杂问题,实验表现出色。

量子位
新闻资讯8

英伟达All in的物理AI路线,居然是中国黑马提前一年就定义好了

全球具身智能行业为技术路线争论时,中国深度机智率先提出并跑通「人类学习」路线,以人类数据为起点、动作建模为中心、机器人为AI而生,英伟达等跟进,深度机智全栈落地且进度领先。

新智元
算法论文8

Transformer已死?DeepMind正在押注另一条AGI路线

谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。

新智元
算法论文8

给GRPO加上运筹外挂让7B模型比肩GPT-4!Li Auto团队发布多目标强化学习新框架 | ICASSP 2026

文本摘要质量评估需兼顾多维度,但开发者优化时易顾此失彼。Li Auto团队提出HVO,基于GRPO框架,让7B模型在摘要任务媲美GPT - 4,且生成内容更简洁,成果被ICASSP 2026接收。

量子位
新闻资讯7

一手奶瓶一手键盘!新手宝妈产假氛围编程,自研实用家庭App

新加坡宝妈Laura Zaccaria产假自研家庭餐食规划App。她无编程背景,靠Cursor等工具学习AI迭代快,她意识到要跟上,产假成自我进化契机,提醒大家学习才能不被时代抛下。

新智元