学习效率」共找到 2463 篇相关文章

算法论文8

RL特训出「押题大师」?破解模型微调中的多样性危机与灾难性遗忘

近年来,基于可验证奖励的强化学习(RLVR)成为提升大语言模型推理能力的重要路径,但许多经RL微调的模型出现‘越训越单一’问题。复旦大学等团队聚焦长期被忽视的KL散度项,提出DPH - RL方法,可缓解多样性坍塌。

新智元
推荐文章8

拒绝重复造轮子!抽象 80% 工作场景,打造可复用的"AI 助手工厂”

文章指出,为解决重复开发AI助手的效率问题,智空间团队将高频需求抽象为可复用技术方案,打造“AI助手生产线”。介绍四大高频场景本质、共性挑战及对应方案,还阐述分层架构、解决方案、prompt架构等,最终落地“助手工厂”产品。

阿里云开发者
产品应用8

AI 推理精细化流量治理实战:RocketMQ LiteTopic 的“千人千面”流控方案

随着大模型推理服务成主流,传统消息队列限流机制在AI推理场景面临挑战。Apache RocketMQ 5.x推出LiteTopic,其精细化流量治理方案能实现‘千人千面’,解决队列头部阻塞和并发效率受损问题,还与阿里云百炼网关合作。

阿里云开发者
新闻资讯8

30人团队震撼英伟达!Jim Fan自曝三个教训,重押世界模型

英伟达Jim Fan带队创立GEAR实验室,30人团队产出惊人,涵盖机器人学习完整技术栈。团队有GR00T基础模型等成果,Jim Fan还分享三个教训,重注视频世界模型,提出仿真世界三阶段,指出物理AI未来是新基础设施。

新智元
算法论文8

PPO-Clip的「盲点」被补齐了?快手提出熵比裁剪方法,从局部约束到全局稳定的关键一跃

快手科技语言大模型团队提出熵比裁剪(ERC)方法,应对强化学习中信任域偏离问题。该方法从全局视角稳定策略分布,在多个数学推理基准实验中提升了模型性能,还与多种方法对比验证了泛化能力。

机器之心
算法论文8

LeCun在Meta的最后一篇论文

LeCun于11月11日提交最新论文《LeJEPA:无需启发式的可证明且可扩展的自监督学习》,当天其离职Meta消息曝光。论文提出LeJEPA自监督学习方法,解决表示崩溃问题,还回顾了JEPA架构发展,虽毁誉参半,但LeCun将继续推进世界模型工作。

量子位
新闻资讯7

2025 的企业 AI 市场, Data &AI 占据主流视野

数据是 AI 模型学习和训练的基础,Data & AI 基础设施可打通数据与 AI 全链路。企业应用 AI 不应只关注算法和算力,还需重视私域数据。同时介绍了不同类型企业在 Data & AI 领域的特点及合作成本等内容。

InfoQ
新闻资讯7

全球95%企业AI惨败?MIT报告引硅谷恐慌!90%员工偷用ChatGPT续命

MIT报告《The GenAI Divide: State of AI in Business 2025》指出,95%企业AI试点项目失败,但90%员工用ChatGPT等个人AI工具办公。消费级工具因灵活易用胜企业级,企业应向员工学习,与供应商合作。摩根士丹利报告称AI可为企业省成本。

新智元
产品应用7

Cursor为Blackwell从零构建MXFP8内核,MoE层提速3.5倍,端到端训练提速1.5倍

Cursor团队从NVIDIA的Hopper H100s升级到Blackwell B200s后遇性能瓶颈,他们回归基础,从零重写MoE训练层,抛弃对现有CUDA库依赖,释放了Blackwell架构潜能,实现MoE层和端到端训练提速。

机器之心
新闻资讯8

AI上清北,普通人该怎么办?|甲子光年

2025年AI模拟高考成绩达清北线,引发对人类努力意义的思考。三位嘉宾围绕AI能力进步、与人类能力差异、对教育和创作的影响等展开对谈,探讨人类在AI时代的定位、专业选择、教育变革等问题。

甲子光年