机器学习专家」共找到 2008 篇相关文章

新闻资讯7

OpenAI推理第一人创业了:要造“活到老学到老”的AI,先来融它70个亿

OpenAI推理模型第一人Jerry Tworek离职不到一个月就创业,新公司Core Automation计划筹集10亿美元,要做具备「持续学习」能力的新型AI模型,解决主流模型‘训完就上线’、能力固定的问题。

量子位
新闻资讯8

2025宝山·智能机器人产业大会暨嘉年华隆重开幕

2025年11月21日,‘2025宝山・智能机器人产业大会暨嘉年华’在智慧湾科创园开幕。领导、院士专家、企业代表齐聚。会上发布行动方案,启动多个平台与中心,完成项目签约与揭牌,还有主旨演讲及多场活动。

机器之心
新闻资讯7

中国机器人产业生态营在首钢园开营,构建产业协同新范式

10月30日,中国机器人产业生态营在首钢园开营,由首程控股发起。其整合多方资源构建闭环式创新生态,旗下基金已投资多家企业。生态营学员多元,罗振宇进行AI夜话分享,后续还有专家授课。

首钢园
新闻资讯7

2050大会 | 「AGI4Science·新生论坛——正在生长的科学地图 」嘉宾阵容全览!

2026年4月25日上午9点,2050大会将迎来“AGI4Science·新生论坛”专场。该论坛由王婷召集,以“三幕剧”展现AI for Science从理论到产业的图景,涵盖多领域,17位专家将探讨AI4S的生长与变革。

深度学习自然语言处理
算法论文8

人形机器人控制新突破!敏捷稳定两不误,一个策略让人形机器人完成叶问蹲和跳舞|港大&英伟达&清华

港大、NVIDIA和清华联合团队提出AMS统一人形机器人全身控制框架,首次在单一策略实现动态运动跟踪和极限平衡控制。通过异构数据源、混合奖励机制和自适应学习策略,解决数据限制和优化目标冲突问题。

量子位
新闻资讯8

刚刚,DeepSeek论文登上Nature,更多细节披露!

9月17日,梁文锋担任通讯作者的DeepSeek - R1推理模型研究论文登《Nature》封面,它是全球首个经同行评审的主流LLM。不靠人工标注,靠强化学习激发推理能力,学会‘自我反思’,在多任务上优于传统模型。

PaperAgent
算法论文8

Agent学会自己「长」Skill了!从失败里长出经验,比人类写的更好用|ICML 2026

ICML 2026接收论文提出EvolveR,让Agent从自身成败轨迹自动蒸馏“经验”,经闭环生命周期形成“认知Skill”,维护经验库,用强化学习让其学会“使用经验”,在多跳问答表现优。

量子位
算法论文8

视觉思维链全新架构,加州大学让多模态大模型有了灵性,整体性能提升5.3%

加州大学伯克利分校等团队提出视觉思维链(CoVT)架构,让视觉语言模型推理时生成连续视觉信号。它内化轻量级专家能力,采用对齐策略和四阶段训练,实验显示性能提升,还具可解释性。

AIGC开放社区
新闻资讯8

信息量爆炸!OpenAI内部路线图首次全曝光,首席科学家亲口承认:超级智能10年内到来

OpenAI宣布重组完成后,Sam Altman和首席科学家Jakub Pachocki直播公开内部路线图,称深度学习或10年内实现超级智能,还公布了AI研究目标与时间线,涉及产品、基建等多方面规划。

AI寒武纪
算法论文8

冗长响应缩减80%,DeepSeek GRPO获得颠覆性改进,微软GFPO问世

微软研究员曝出颠覆性强化学习算法 GFPO,能削减推理多余 token 长度达 80%。它基于 DeepSeek 的 GRPO,可同时优化多响应属性,团队还提出自适应难度变体,实验显示 GFPO 在多方面表现出色。

机器之心