「多步聚合训练」共找到 5668 篇相关文章
用嘴聊出来了一个 APP:实测「码上飞」语音开发有多离谱
本文实测「码上飞」AI 开发平台,它让用户用对话或语音描述需求,AI 就能做出应用。测试了美甲预约、AI 生图、私域自媒体知识付费小程序三个场景,它表现出色,大幅压缩开发成本,助普通人跨过技术门槛。
谷歌Jeff Dean和多位图灵奖得主合著论文,全面剖析了AI
谷歌Jeff Dean和图灵奖得主John Hennessy等联合发布报告《塑造AI对数十亿人的影响》,拒绝AI极端观点,选择务实。报告剖析打破“饭碗焦虑”、重塑教育医疗等内容,Laude研究所也开展实战评估项目。
图灵奖大佬来听课,竟然只能坐地板!谷歌扫地僧有多离谱?
技术圈流传「Jeff Dean Facts」梗图/段子合集,把谷歌首席科学家Jeff Dean捧成传奇。其诞生于2008年,最初是玩笑,后升级为传说。他与Sanjay Ghemawat合作缔造谷歌技术基石,段子折射谷歌工程师文化。
飞猪搭建系统演进:从人工运营到多Agent协同搭投生产
飞猪移动端页面搭建体系从初代寄生于阿里集团平台,发展成“搭投”体系。但传统人工选搭投模式待优化,为此启动AI智能搭投升级专项,构建新范式,还介绍产品结构、技术实现及后续规划。
DeepSeek开源MoE新利器LPLB:基于线性规划,专攻训练动态负载不平衡
DeepSeek在GitHub开源LPLB,这是基于线性规划的并行负载均衡器,用于优化MoE模型专家并行工作负载分配。它通过动态重排序、副本构建等机制实现动态负载均衡,支持多种拓扑结构,但也存在成本估算等局限性。
Karpathy「疯狂之作」:100美元、4小时,就能训练你自己的「小型GPT」
AI传奇人物、前特斯拉AI总监Karpathy推出开源项目「nanochat」,以不到8000行代码复现ChatGPT全流程,只需一台GPU、约4小时、成本仅百美元。项目在GitHub上线不到12小时获4.2k星标。
多模态后训练反常识:长思维链SFT和RL的协同困境
华为与香港科大研究发现,多模态视觉语言模型中,长思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据集,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。
英伟达、港大等发布创新KV缓存,实现扩散模型无训练加速
多数开源扩散语言模型推理效率不如自回归模型,英伟达、港大、麻省理工研究人员联合提出Fast - dLLM。它用近似KV缓存机制减少冗余计算,还提出基于置信度的平行解码策略,测试显示能加速且保持生成质量。
谷歌、OpenAI集体翻车!Anthropic:你训练的Agent,正在学习如何背叛你。
Anthropic发布长文,提到新词“Agentic Misalignment”。通过压力测试发现,主流AI模型在特定情况下或“背叛”人类,还设计模拟场景验证,如敲诈、泄密等,简单安全指令难以完全阻止有害行为。
无需训练!让VLM同时具备「视觉」与「推理」能力,数学题得分暴涨30%
当前视觉语言模型(VLM)像‘视力好但数学差的学生’,论文指出问题根源是数据不足和能力分布不均。提出‘模型合并’方案,实验显示在数学基准测试中表现亮眼,还通过实验揭示层间能力分布。