「经验学习」共找到 1809 篇相关文章
深度视角 | 物理法则如何“纠偏”AI黑盒?首篇社会物理学引导的深度学习(SGDL)综述深度解析
近日,清华等多机构发布全球首篇SGDL系统性综述。文章介绍SGDL诞生背景、核心架构、应用场景,探讨其与大模型结合潜力,也指出面临的挑战,认为其是思维范式跃迁,正构建智能社会蓝图。
Karpathy最新手搓!复现GPT-2成本狂降600倍:仅需507元3小时训练「最好的AI学习项目」
Andrej Karpathy的个人项目nanochat更新,现训练GPT - 2级别的LLM成本低于100美元,在单个8XH100节点上仅3小时花约73美元,较7年前成本降600倍,还列出关键优化技术,设排行榜。
API7.ai创始人温铭:烧了几百亿Token,我用AI重写了生产级网关,总结出6条经验
API7.ai创始人温铭分享用AI重写生产级网关经验。他认为AI编码能力超资深工程师,瓶颈在人。还介绍在公司‘禁手写代码’的情况,以及AI代码审查、使用阶段等内容,最后说明重写AI网关AISIX的原因。
大模型开发者必读!拆解世界级AI模型的诞生,Hugging Face把4年模型训练经验写成了一本开源指南
Hugging Face发布《The Smol Training Playbook》,分享约4年构建SOTA模型和数据集的经验。手册涵盖是否训练、训练何种模型、如何训练等内容,强调数据质量重要性,还介绍了模型设计、训练中的实践与教训。
《TAML》好文推荐 | 来自中国科学院力学研究所张磊博士 评估大语言模型在计算流体力学领域的知识利用、学习与创造
研究聚焦评估推理型(DeepSeek R1和OpenAI o3 - mini - high)与非推理型(DeepSeek V3和ChatGPT 4o)大语言模型在计算流体力学领域知识利用、学习与创造能力。通过三类基准问题评估,结果有差异。
首个为具身智能而生的大规模强化学习框架RLinf!清华、北京中关村学院、无问芯穹等重磅开源
人工智能从‘感知’迈向‘行动’,具身智能成焦点。当前强化学习框架对具身智能支持受限,清华等机构联合开源面向具身智能的框架RLinf,提出混合式执行模式,设计灵活可扩展,在多方面表现出色。
4小时喜提专属 ChatGPT、卡帕西又整活!自曝Agent帮倒忙、手搓八千行代码,网友:跑完就当上机器学习工程师
特斯拉前AI总监安德烈·卡帕西发布开源项目nanochat,是极简全流程训练/推理工具链,可搭建简易版ChatGPT复现模型。花100美元最快4小时能训练出可对话模型,代码基本手写,网友热度高。
智谱首秀工程实战经验!Coding Agent日均数亿次调用,GLM-5把长上下文推理的底层问题全逼出来了
今年 2 月智谱 GLM Coding Plan 上线后很受欢迎,随着用户和调用量上涨,Coding Agent 成压力测试场。4 月 30 日智谱发布博客,披露 GLM - 5 系列模型在超大规模 Coding Agent 调用场景下的底层推理技术突破及工程实践经验。
亚马逊开建AGI实验室,一号位也是华人
亚马逊借Gen AI浪潮转型,去年9月成立Amazon AGI SF Lab,一号位是华人David Luan。实验室高手云集,其首个产品Amazon Nova Act表现出色,秘诀在于强化学习,为AI搭建“健身房”。
评论送书 | Al智能体与传统AI应用的区别?它如何工作?如何快速构建智能体?
文章对比AI智能体与传统AI应用,指出前者更像“乐高积木”,可融入生活工作。介绍其工作是“感知—推理—执行—学习”循环,还给出快速构建通用方法,如明确目标、选框架等。