训练策略」共找到 2790 篇相关文章

开源动态8

阿里开源电影级AI视频模型!MoE架构,5B版本消费级显卡可跑

阿里开源新一代视频生成模型通义万相Wan2.2,含文生视频等功能。它率先将MoE架构用于视频生成扩散模型,5B版本可在消费级显卡部署。对比前代和Sora表现更优,还推出电影级美学控制系统。

量子位
新闻资讯7

节目预告丨艺术⁺Talk—AI 艺术创作的边界探索

2025年AI融入艺术创作,艺术从业者面临诸多选择。此次Talk将围绕AI对艺术创作主权、表达路径与生存策略的影响展开对话,探讨艺术创作边界,还介绍了嘉宾、直播信息等。

搜狐看展
推荐文章7

普通程序员怎样转到AI方向拿到更好的offer

在AI研究员拿天价offer的当下,探讨普通程序员转AI方向拿更好offer的方法,还介绍了AI生态的五个层次,包括各层岗位、年薪及容量。

王喆的机器学习笔记
新闻资讯7

烧钱换能力,老员工经验作废!一线Agent厂商、用户经验亲述:抛弃技术驱动,巨额投入如何不打水漂?

InfoQ 对话来也科技 CEO 汪冠春、英科医疗 CTO 陈坤,从产品提供商和应用方角度,讲述 Agent 产品理念与应用策略。探讨定位、转型、挑战等,还提及成本、未来设想与出海经验。

AI前线
产品应用7

The Batch: 848 | 走进沃尔玛的 AI 应用工厂

全球营收最高的零售商沃尔玛披露其云平台与模型无关的 AI 应用开发平台 Walmart Element 最新细节,介绍其工作原理、典型应用,还提及平台推出目的、原则及意义。

DeeplearningAI
算法论文8

快慢Reasoning综述!

大型语言模型在复杂推理任务中有‘无差别计算’缺陷,阻碍其在多场景应用。本文提出双层效率优化框架,梳理两类前沿技术,通过实验揭示瓶颈,为轻量化推理指明路径。

深度学习自然语言处理
开源动态8

突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度

在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。

量子位
算法论文8

DeepSeek推理最高提速6倍!开源研究:加装「思维进度条」,计算量减少30%

特拉维夫大学团队开发新方法,给LLM推理任务装进度条,控制推理深度和速度。提出“思维进度向量”TPV预测推理位置,干预TPV可“超频”“降频”,模型已在GitHub开源。

量子位
推荐文章7

上下文就是一切!行业热议话题:提示工程是否应该改名

AI圈热议提示工程是否应改名“上下文工程”。Shopify CEO等发表看法,指出其在LLM应用和AI Agent构建中很重要,还分析了重要性、优化方法,给出实践经验,强调要在性能、成本和准确性间平衡。

歸藏的AI工具箱
产品应用8

Agent 成大厂新“战场”?从同程旅行 DeepTrip 看垂类 Agent 的设计与落地实践

文章聚焦同程旅行推出的垂类旅行 Agent DeepTrip,介绍其设计与落地实践。它能降低旅行决策成本,构建旅行服务生态。团队基于多方面考量选 Agent 架构,还从多维度介绍实现方法及未来规划。

InfoQ