迭代课程学习」共找到 1767 篇相关文章

算法论文8

奖励模型终于迎来预训练新时代!上海AI Lab、复旦POLAR,开启Scaling新范式

在大语言模型后训练阶段,奖励模型设计与训练是关键瓶颈。上海AI Lab、复旦推出预训练奖励模型POLAR,采用策略判别学习新范式,适配强化微调,性能和泛化能力强,为LLM后训练带来新可能。

机器之心
推荐文章7

取消AI考核、零裁员!股价暴跌82%后,多邻国走出了一条反硅谷之路

多邻国曾是AI转型标杆,后股价暴跌82%。其联合创始人兼CEO Luis von Ahn在访谈中称未裁员,还分享公司用AI情况,如取消AI考核、员工用AI做课程等,也谈到了AI局限和各职业前景。

InfoQ
推荐文章7

24小时快速入门大热语言Rust!学不会来找我

文章从Rust核心语法等基础入手,介绍其不同于其它语言的思维方式,还通过实战项目带读者入门。阐述了安装、工具使用,用greplite小程序介绍语言特点,讲解组织数据方式、所有权等,最后实现mini - redis并给出学习建议。

腾讯技术工程
开源动态8

美团新独立APP,点不了菜只能点AI

美团新开源LongCat-Flash-Omni模型,支持多模态,在全模态基准测试达开源SOTA水准,推理快且全模态能力强。实测交互体验丝滑,其代逻辑清晰。该模型成功源于架构创新,美团靠软硬件结合实现虚实连接。

量子位
8

制造企业如何实现 AI 产品经理“能力复制”?|极客时间 AI 人才培养实践

在数智化转型中,企业 AI 培训常难以转化业务价值。极客时间为某制造企业定制 AI 产品经理 OMO 训练营,以业务场景为导向,采用三阶段闭环培养模式,课程覆盖全链路,助企业培养人才、建立培养体系。

AI前线
开源动态8

交互扩展时代来临:创智复旦字节重磅发布AgentGym-RL,昇腾加持,开创智能体训练新范式

强化学习之父指出人工智能迈入「经验时代」,在此背景下,复旦、创智、字节研究者发布 AgentGym - RL 框架。它是全新端到端 RL 框架,提出 ScalingInter - RL 方法,7B 模型经训练追平顶尖商业模型,为 AI 发展注入动力。

机器之心
算法论文8

智能体新范式Chain-of-Agents,多项任务新SOTA

论文提出Chain-of-Agents (CoA) 范式,结合多智能体系统与工具集成推理优势。通过多智能体蒸馏和智能体强化学习训练智能体基础模型(AFM),实验显示其在Web和Code任务上达新SOTA,效率、泛化性佳。

深度学习自然语言处理
推荐文章8

120页深度报告,搞懂今年大模型和应用的现状与未来

Innovation Endeavors合伙人Davis Treybig发布《State of Foundation Models》(2025),从七个维度剖析AI产业现状与趋势。报告指出,AI发展迅速,模型成本高且代快,应用渗透各行业,智能体崛起,市场结构变革,公司运作方式也在重塑。

Founder Park
算法论文8

T-PAMI|中国科大、合工大等提出CAPER++:让关节物体位姿感知真正迈向「又快又稳」

在具身智能发展下,关节物体位姿感知难题待解。中国科大、合工大等团队提出 CAPER++ 框架,从关节驱动视角建模,将位姿学习拓展至 SE (3) 流形切空间,实现端到端推理,兼顾精度、鲁棒性与实时性。

机器之心
开源动态8

写Verilog、调CUDA,总翻车?工业代码大模型开始学会「先想后写」了

工业代码大模型缺的往往是‘想’的能力。北航联合多家单位提出的InCoder - 32B Thinking,让模型结合工业环境思考,通过ECoT从错误中学习,用ICWM提前预判结果,还能自适应思考深度,且模型与代码已开源。

机器之心