深度学习模型训练」共找到 8697 篇相关文章

推荐文章8

LlamaIndex 深度实战:用《长安的荔枝》学会构建智能问答系统

文章兼顾 RAG 科普与 LlamaIndex 实战。介绍 RAG 原理,用《长安的荔枝》讲解关键步骤和参数。实战部分展示用 LlamaIndex 搭建问答系统,代码量少。优化篇通过实验给出参数调优建议,架构篇剖析内部机制,最后提及 Agent 化拓展功能。

阿里云开发者
产品应用8

AI 代码审查再进化:AutoDev 多智能体协作架构深度解析

现代软件开发中,代码审查存在信息割裂、人工效率低等痛点。AutoDev 借助多智能体协作与信息聚合,实现从分析到修复的闭环智能流程,还构建多 Agent 协作体系,未来将集成更多能力。

phodal
算法论文8

稳定训练、数据高效,清华大学提出「流策略」强化学习新方法SAC Flow

本文介绍清华大学和CMU提出的SAC Flow新方案,可端到端优化流策略。它将流策略视作residual RNN,用GRU和Transformer结构稳定训练。在多环境测试中表现优,有稳定、快速、样本效率高的特点。

机器之心
推荐文章7

Palantir 创始工程师深度分享:FDE 模式是 Agent 时代的 PMF 范式

本文编译前 Palantir 高管 Bob McGrew 对 FDE 模式的思考。FDE 团队填补产品与客户需求差距,交付有价值成果。在 AI Agent 时代,因产品需大量探索且要从企业内实践出发,FDE 或成创业公司新范式。

海外独角兽
算法论文7

ICLR 2026惊现SAM 3,分割一切的下一步:让模型理解「概念」

9月12日,匿名论文‘SAM 3: SEGMENT ANYTHING WITH CONCEPTS’登陆ICLR 2026,外界猜测出自Meta。SAM 3定义了可提示概念分割任务,性能比之前系统提升至少2倍,在多基准测试获SOTA成绩,但也有人质疑是旧概念包装。

机器之心
开源动态8

字节开源图像生成“六边形战士”,一个模型搞定人物/主体/风格保持

字节UXO团队设计并开源统一框架USO,解决图像生成多指标一致性问题。它能统一看似孤立任务,实现单任务和组合任务的SOTA,弥补了主体保持和风格迁移短板,性能领先,还采用新范式及算法。

量子位
算法论文8

Discrete Tokenization:多模态大模型的关键基石,首个系统化综述发布

近年来,人们关注将LLM能力扩展至非文本模态,Discrete Tokenization成关键方案。但现有研究缺系统总结,香港科技大学等团队发布首个相关系统化综述,梳理技术脉络、方法及挑战,给出未来研究方向。

机器之心
算法论文7

支持5000+ Server,ScaleMCP为大模型Agents动态同步MCP工具

现有工具选择框架未整合MCP服务器,存在重复、不一致和低效问题。普华永道提出ScaleMCP,配备MCP工具检索器,还提出TDWA嵌入策略,通过实验证明其提升了LLM代理性能。

PaperAgent
新闻资讯7

A社旗舰Fable 5卖不动了。。两款神秘新模型已现身

支付平台Ramp统计显示,A社旗舰Fable 5上线两月销量不佳,收入仅占整体的11.4%。其价格高、性价比低,拖累公司收入未达预期。同时,X上出现Claude的两个神秘内测代号,或几周内上线。

量子位
产品应用8

从日志学习到风洞验证:构建 GPU 集群的 AI Native 稳定性闭环

文章介绍了面向新引入GPU芯片稳定性验证的AI Native治理体系“算力风洞”。其通过厂商环境自动复刻等手段,将新芯片适配效率提升10倍以上。体系分认知、验证、进化三层,形成完整闭环,推动智算集群稳定性建设升级。

阿里云开发者