「AI强化学习」共找到 10536 篇相关文章

新闻资讯8

显卡为什么卖得越来越贵?NVIDIA 副总裁:别争了,摩尔定律早就死透了

NVIDIA应用深度学习研究副总裁Bryan Catanzaro在播客中指出,嘲笑中国AI“套壳抄袭”是偏见,中国在开源协作上是全球领跑者。他认为摩尔定律已死,显卡难降价,还分享了对开源闭源、模型技术等看法。

AI科技大本营
新闻资讯7

去往 Capital One 的俞栋,曾是 Hinton 的「救命恩人」

近日原腾讯AI Lab副主任俞栋加入Capital One。此前他和邓力曾在微软为Geoffrey Hinton雪中送炭,挽救深度学习研究。如今邓力、俞栋等技术大佬纷纷投身金融公司,或是因薪资、挑战和资源等因素。

AI科技评论
推荐文章8

Agent性能暴涨90%,刷榜GAIA可太容易了~

今年AI Agent层出不穷,当前研究缺乏统一标准、复现难。oppo Agent团队分享构建高效Agent的关键组件及刷榜GAIA的方法,从事实获取能力和逻辑推理保真度两维度分析,介绍了强化感知和提升思维的策略。

探索AGI
算法论文7

英伟达发现RL Scaling!创造力暴涨,做基座模型做不了的事!

过去学界争论强化学习(RL)对语言模型的作用,此前研究认为其效果有限。本文发现问题出在训练时间短,提出ProRL,让训练突破2000步以上,结果惊人,小模型也能有出色表现。

深度学习自然语言处理
新闻资讯7

投85份简历0 Offer!CS研究生心态崩了,亲历20年最猛裁员潮

今年美国裁员破百万,十月裁员规模创2003年来同期新高,AI成背后推手。一机器学习研究生狂投85份简历无果,微软等巨头也加入裁员潮,却仍能实现收益递增,出现“无就业增长的繁荣”。

新智元
算法论文9

假如有一万张卡,RL训练该怎么扩大规模?十万张呢?

本文是腾讯混元团队针对大模型强化学习规模化训练的研究,聚焦万卡级算力下Batch Size优化问题,拆分样本效率与系统效率的影响,给出可落地的调优框架,实测可缩短29%训练时间。

机器之心
开源动态8

社区供稿丨35B参数科学性能比肩万亿参数模型,『书生』科学大模型Intern-S2-Preview开源

5月15日,上海AI实验室开源新一代大模型预览版Intern - S2 - Preview,参数35B,多领域比肩万亿参数模型。它深化与昇腾算力生态协同,探索‘通专融合’,强化科学及智能体能力,‘算法 - 系统 - 算力’协同提升训推效率。

Hugging Face
产品应用8

深度拆解沐曦MXMACA软件栈功能,算力自主+生态兼容,破解国产GPU落地难题

近日,刚 IPO 的沐曦股份发布 MXMACA 软件栈 3.3.0.X 版本。该软件栈可实现多语言支持、算子自动优化与跨框架平滑适配,能让现有 CUDA 项目近乎‘开箱即用’迁移,还兼容主流 AI 框架,助力国产 GPU 解决落地难题。

机器之心
新闻资讯7

奥特曼:感受不到GPT-5变强,是因为你还不够「专业」

GPT-5发布后口碑不佳,直播事故、网友吐槽、专家唱衰不断,有人喊出‘AI第二次寒冬要来了’。但奥特曼认为这是节奏和期待错位,GPT-5在科研等高阶领域有提升,技术范式也有转变,且OpenAI仍看重规模。

新智元
开源动态7

2万开源项目已用上,OpenAI下了盘大棋,Cursor,Codex智能体纷纷支持

据彭博社消息,DeepSeek计划年底发布可自主执行多步任务、自我学习进化的AI Agent。OpenAI开源的AGENTS.md已获5k星,为编码智能体提供使用说明,还给出示例和使用指南,相关智能体已用于2万开源项目。

PaperAgent