混合课程学习」共找到 1601 篇相关文章

产品应用8

大模型首次打破围棋思维「黑盒」,打通科学发现新路径!上海AI Lab发布新一代InternThinker

上海AI Lab发布新一代书生·思客(InternThinker),它是我国首个具围棋专业水平且能展示透明思维链的大模型。其得益于InternBootcamp训练环境,还在多任务混合训练中现‘涌现时刻’,背后有通专融合底层技术突破。

量子位
推荐文章8

真正的AI竞争力,藏在大模型“后训练”这一步

当全球聚焦基座模型参数竞赛时,后训练变革正悄然发生。产业共识是,大模型后训练是AI落地产业必经之路。后训练技术从SFT演进至强化学习范式,企业应用也有了从技术到商业价值的完整链路。

量子位
新闻资讯8

吴恩达:一边是CS毕业生“过剩”,一边是AI人才抢破头,问题出在哪?「cs专业依然是王牌」

吴恩达分享对CS专业人才市场的观察,指出市场对AI开发者需求未满足,而新毕业CS学生失业率上升。根源是高校课程未跟上AI提升编程生产力的步伐,还阐述了AI工程师核心能力及人才短缺趋势等。

AI寒武纪
新闻资讯7

一口气集齐老黄苏妈英特尔,还得是AI,还得是联想

CES 2026上,各大厂商行动显示所有设备将成AI设备,有「物理AI」等新趋势。联想集团杨元庆提出混合AI是推动AI普及的终极路径,联想还发布相关产品,展现其在AI生态的优势。

量子位
开源动态8

腾讯混元世界模型HY-World 1.5开源,24 FPS的实时交互世界建模

腾讯混元世界模型HY - World 1.5开源,实现24 FPS实时交互世界生成。它采用双重动作表征等技术,解决了长程生成问题,还通过强化学习等优化,在多方面表现出色,为具身智能场景模拟奠基。

AIGC开放社区
推荐文章7

AI 会取代人类思考吗?我们为什么仍要亲手写作和编程

文章探讨AI是否会取代人类思考,指出不能过度依赖AI,如写作和编程应亲力亲为。还给出使用AI的指南,引用多方观点说明人类在创作、决策等方面的价值,以及学习编程和掌控AI的重要性。

宝玉AI
推荐文章7

入局AI Infra:程序员必须了解的AI系统设计与挑战知识

文章分享传统后台工程师技术栈和方法论如何迁移到AI系统,系统性拆解AI Infra的硬件、软件、训练和推理挑战,如硬件从CPU到GPU、软件依赖深度学习框架,还分析训练和推理面临的问题及解决办法。

腾讯技术工程
推荐文章7

如何像 Manus 交付业务需求-- OneAgent + MCPs 范式

文章介绍 Agent 发展历程,从单一 LLM 调用到 OneAgent + MCPs 范式。Manus 是 Loop 框架典型代表,将其与 Cline 开发范式结合企业 MCP Server,可完成多业务需求。同时指出该范式不足及发展方向,还介绍强化学习应用。

阿里云开发者
算法论文8

「推理革命」爆发100天:DeepSeek-R1复现研究全揭秘!

本文深入梳理围绕DeepSeek-R1的复现研究,解析监督微调、强化学习等关键技术细节,介绍相关数据集、训练方法及奖励机制等,还探讨了推理语言模型更多发展方向,为研究提供基础。

新智元
推荐文章8

从DeepSeek-V3到Kimi K2:八种现代 LLM 架构大比较

文章对比了DeepSeek-V3、Kimi K2等八种现代LLM架构。介绍各模型独特技术,如DeepSeek V3的多头潜在注意力和混合专家技术,OLMo 2的后归一化策略,Gemma 3的滑动窗口注意力等,探讨架构改进与突破。

PaperAgent