机器学习专家」共找到 2008 篇相关文章

开源动态8

Karpathy最新手搓!复现GPT-2成本狂降600倍:仅需507元3小时训练「最好的AI学习项目」

Andrej Karpathy的个人项目nanochat更新,现训练GPT - 2级别的LLM成本低于100美元,在单个8XH100节点上仅3小时花约73美元,较7年前成本降600倍,还列出关键优化技术,设排行榜。

AI寒武纪
新闻资讯8

超150位全球AI一线技术专家齐聚巴黎,这场大会到底聊了些什么?|GOSIM Paris 2026圆满收官

5月6日,GOSIM Paris 2026进入第三天,议程转向技术实践。超150位全球AI专家齐聚,探讨模型推理优化、开源社区治理等。Niko Matsakis等分享前沿观点,还有五大主题论坛及工作坊,展示开源AI生态成果。

AI科技大本营
算法论文7

《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模型在计算流体力学领域的知识利用、学习与创造

研究聚焦评估推理型(DeepSeek R1和OpenAI o3 - mini - high)与非推理型(DeepSeek V3和ChatGPT 4o)大语言模型在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。

力学与人工智能
开源动态8

首个为具身智能而生的大规模强化学习框架RLinf!清华、北京中关村学院、无问芯穹等重磅开源

人工智能从‘感知’迈向‘行动’,具身智能成焦点。当前强化学习框架对具身智能支持受限,清华等机构联合开源面向具身智能的框架RLinf,提出混合式执行模式,设计灵活可扩展,在多方面表现出色。

机器之心
算法论文8

只需一次指令微调,大模型变身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral

预训练大模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙大与Thomson Reuters团队提出SIMoE,单阶段微调就能升级大模型,还解决传统方法两大局限,在性能和效率上双突破。

量子位
开源动态8

我去,短短时间,狂揽27.4K星,Windows用户的春天,任务栏秒开Linux的「神器」来了,6的飞起

由 Cascadium 团队打造的 WSL Windows Toolbar Launcher,将 Linux 终端装进 Windows 任务栏。它有一触即发控制台、状态感知任务栏等功能,适用全栈开发、机器学习等场景,与同类项目相比优势明显。

小华同学ai
开源动态8

X平台如何决定你看到什么?马斯克刚刚开源了X推荐引擎

马斯克开源X平台推荐算法,消除人工干预特征,靠Grok模型理解用户行为。系统由编排、存储和机器学习层协同,经复杂机制精准推送信息,还构建后置过滤体系保证内容质量。

AIGC开放社区
推荐文章7

统一框架下的具身多模态推理:自变量机器人让AI放下海德格尔的锤子

当前先进机器人无法像人类自如用工具,现有多模态系统有局限。自变量机器人提出端到端统一架构,以统一表示学习和多任务多模态生成解锁具身多模态推理能力,实现范式转换。

机器之心
算法论文8

破解MoE模型“规模越大,效率越低”困境!中科院自动化所提出新框架

大模型参数量飙升却陷入‘规模越大,效率越低’困境,中科院自动化所研究团队提出统一框架,直击MoE底层运作模式,让专家‘组队学习’,实现参数量、负载方差降低,达成三重优化。

量子位
新闻资讯7

分化、新范式、Agent 与全球 AI 竞赛,中国模型主力选手们的 2026 预测

AGI-Next 2026活动聚集众多国内大模型核心人物,「海外独角兽」总结出40条重要判断。涉及模型分化、新范式(自主学习、原生多模态)、Agent、全球AI竞赛等方面内容,对AI未来发展趋势做出探讨。

Founder Park