端到端训练」共找到 4163 篇相关文章

开源动态8

6.1B打平40B Dense模型,蚂蚁开源最新MoE模型Ling-flash-2.0

蚂蚁百灵大模型团队开源 MoE 大模型 Ling-flash-2.0,其以轻量级配置展现卓越性能,在推理速度、任务性能、部署成本间找新平衡,为大模型‘参数膨胀’提供新路径,还在多领域应用表现出色。

机器之心
推荐文章7

一文讲清三种AI应用系统的架构及及TOP威胁框架

文章从AI系统分类及架构出发,分析不同类型AI系统的威胁特征,并介绍现有的威胁分析框架。目前AI应用架构经历从GenAIAI Agents,再Agentic AI的演进,各方向独立发展,且威胁各有特点又有重合。

AI与安全
产品应用7

企业微信给AI写了94份说明书,Claude Code现在能直接干活

北京时间8月17日,企业微信更新,将能力域从7个扩12个,参考文档扩94份。介绍了其能操作的业务品类,分析文档权重体现的产品意图,阐述三个设计细节,指出想象空间、机会及坑,强调此次更新比首次更重要。

AI Reading Hub
产品应用8

离谱!现在的Agent都卷成100个成团了?3分钟并行干完5个复杂任务,还能随时改需求

百度文库、百度网盘联合发布全球首个全通用Agent——GenFlow2.0,能让100+AI专家Agent天团并行工作,3分钟交付5、6个复杂任务,还能随时改需求。它依托权威资料,可控性强,多任务并行,已上线百度文库Web/APP。

量子位
新闻资讯7

星海图高继扬:具身智能下半场,应用为王

星海图CEO高继扬在AGI Playground大会分享具身智能观点,认为2026年是下半场,核心是应用。具身智能发展慢因缺高质量数据和合适本体,未来产品形态或为‘整机+预训练模型+后训练工具’,下游将形成大生态。

Founder Park
算法论文7

一篇多模态大模型推理技术最新综述

华东师大&字节跳动系统回顾基于强化学习的MLLMs推理进展,涵盖关键算法设计、奖励机制创新及实际应用,探讨了RL在LLMs/MLLMs中的关键设计与优化策略,还涉及多模态大模型推理多方面内容。

PaperAgent
算法论文7

苹果提出原生多模态Scaling Law!早融合+MoE,性能飙升秘密武器

如今打造强大多模态模型是AI重要目标,常用方法有局限。法国索邦大学、苹果研究人员开展原生多模态Scaling Laws研究,对比早融合与后融合,探讨多种因素对模型性能影响,发现早融合、多模态MoE优势,为后续研究指明方向。

新智元
产品应用7

终于轮 AI 上夜班了,我去睡

Qoder 推出 Qwen3.7-Max 和 Qwen3.7-Plus 错峰折扣,白天 08:00 22:00,Qwen3.7-Max 5 折;22:00 次日 08:00,Qwen3.7-Max 2 折,Qwen3.7-Plus 4 折。作者测试后认为适合内容创作者,还给出使用建议。

AI产品黄叔
算法论文8

只需一次指令微调,大模型变身全能专家天团,8B模型性能反超全微调基线 | ACL25 Oral

训练大模型适应专业领域需高昂微调成本,稀疏混合专家架构虽能提升推理效率,但从头训练耗资源。浙大与Thomson Reuters团队提出SIMoE,单阶段微调就能升级大模型,还解决传统方法两大局限,在性能和效率上双突破。

量子位
8

苹果应用商店App Store审核指南,审核流程

苹果App Store的审核流程包括准备上传、等待审核、审核中、准备销售等阶段。审核被拒常见原因包括元数据不准确、App完成度不足等。

孔学长