学习方式」共找到 2109 篇相关文章

新闻资讯7

AI5芯片搞定,马斯克的纯自研超算Dojo 3又回来了

马斯克宣布AI5芯片设计进展顺利,特斯拉将重启Dojo 3工作。Dojo项目定位为面向机器学习训练的超算,此前曾暂停。如今Dojo 3将集成AI5或AI6芯片,有望助力特斯拉摆脱对英伟达依赖,自建算力体系。

机器之心
新闻资讯8

英伟达4B小模型击败GPT-5 Pro!成本仅1/36

英伟达ARC - AGI 2中,4B小模型NVARC以27.64%成绩力压GPT - 5 Pro登顶,单任务成本仅其1/36。亮点是零预训练深度学习法,还靠合成数据、测试时微调等策略。小模型特定领域优化后优势明显。

量子位
推荐文章7

从 Langchain 到 Spring AI,我们究竟需要怎么样一个企业级 AI 开发基础设施?

文章指出AI Agent应用开发方式演变快,企业构建AI Agent体系面临挑战。介绍了AI Agent应用架构变化及趋势,如AI应用平台低代码效应、框架与平台双轨并行等,还总结了四类AI Agent框架及企业级框架平台核心考量。

phodal
开源动态8

英伟达&MIT等推出Long-RL,长视频训练速度翻倍

英伟达联合MIT等推出Long - RL,它是面向长序列推理和多模态强化学习的全栈训练框架,能提升RL训练数据长度上限,让训练速度翻倍。其核心MR - SP并行框架可降低训练耗时和显存,LongVILA - R1是其明星应用。

机器之心
算法论文7

大模型刷数学题竟有害?CMU评估20+模型指出训练陷阱

CMU团队评估20多个大模型,发现只有强化学习(RL)训练的模型能将数学推理技能广泛迁移到其他任务,监督微调(SFT)训练的模型迁移有限甚至无迁移。研究还探索差异原因,表明RL微调更具优势。

量子位
新闻资讯7

五源刘凯:喧嚣只是表象,AI创业才刚刚开始|5Y View

五源合伙人刘凯在圆桌会上谈AI创业现状。他认为AI正从集中走向开放,创业者主动权增大。还提及投资AI项目的判断标准,指出ARR在C端产品失去参考价值,不同类型项目评估方式有别,且认为当下AI创业才起步。

五源资本 5Y Capital
推荐文章7

超越 GoF:现代 AI 系统实用设计模式

文章指出AI系统需要设计模式,如GoF塑造软件设计,云计算引入新模式,机器学习社区也有相关模式。文中介绍现代AI系统的5类实用设计模式,含提示和上下文、负责任的AI、用户体验、AI - Ops和优化模式等,并举例说明。

InfoQ
产品应用7

这一夜,中国AI彻底翻身了:DeepSeek R1让全世界刮目相看 | 深度评测

作者深度测试新DeepSeek R1,发现其代码生成能力超Claude 3.7,虽编程全面性有不足,但已处Claude 3.7与Claude 4之间。前端设计审美达Claude 4水准,部分方面略胜,有自主学习推理能力,或改变中国AI历史。

AI产品黄叔
算法论文7

苹果提出原生多模态Scaling Law!早融合+MoE,性能飙升秘密武器

如今打造强大多模态模型是AI重要目标,常用方法有局限。法国索邦大学、苹果研究人员开展原生多模态Scaling Laws研究,对比早融合与后融合,探讨多种因素对模型性能影响,发现早融合、多模态MoE优势,为后续研究指明方向。

新智元
产品应用8

1000+页PDF解析速度暴涨3倍,MinerU模式不香了

百度PaddleOCR推出HPD - Parsing小模型,文档解析速度大幅提升,是上一代最快模型的1.62倍、自身原解码方式的3.06倍。它采用层级并行解码架构,有两层并行设计,效果出色且兼容性好,还分享了优质训练方法和优化思路。

CourseAI