融合策略」共找到 1375 篇相关文章

算法论文8

首创Mid-training范式破解RL奥秘,Llama终于追平Qwen!

上海创智学院和上海交通大学研究团队深入探讨不同基础语言模型在强化学习训练中的差异,提出中期训练策略,将 Llama 改造成适配 RL 的推理基础模型,缩小与 Qwen 性能差距,还发布了 MegaMath-Web-Pro-Max 数据集。

机器之心
开源动态8

音画同步视频生成重磅开源!Character AI和耶鲁大学推出Ovi,让音、画在一个大脑里思考

Character AI和耶鲁大学团队推出开源模型OVI,它采用双骨干交叉模态融合架构,让音视频同步生成。其架构对称,用旋转位置嵌入技术对齐时间,训练策略分步进行,生成效果佳,为开源音视频生成提供新路径。

AIGC开放社区
推荐文章7

诺贝尔经济学奖背后的 AI 投资主线|AGIX PM Notes

本文围绕诺贝尔经济学奖与AI投资展开。以创新驱动的增长范式与AI生产力、商业模式转型相关,还介绍本周全球股市去杠杆情况及AI领域动态,如Meta等公司技术进展,最后解读ETF市场价格与净值关系及投资策略

海外独角兽
新闻资讯7

千问:阿里第二次“无线战争”

本文以乔布斯用 iPhone 点咖啡引出当下科技圈流行发布会点咖啡展示 AI 能力,对比过去与现在,指出数字世界核心范式从移动转向 AI。介绍阿里千问饱和式投入情况,还分析其可能借鉴拼多多、抖音策略,站在长尾对立面。

乱翻书
算法论文8

腾讯AI Lab首创RL框架Parallel-R1,教大模型学会「并行思维」

腾讯AI Lab等机构研究者首创Parallel - R1框架,通过强化学习让大模型掌握并行思维。它解决了RL训练的冷启动和奖励设计难题,在多数学基准上提升准确率,还揭示模型思维策略变化及并行思维的‘脚手架’作用。

机器之心
新闻资讯8

深谋商业化一骑绝尘!人形机器人中标国网电力,大载重eVTOL即将首飞

深谋科技在今年世界人工智能大会上大放异彩,其融合多模态感知检测的人形机器人中标国网河北电力项目,相关技术将应用于关键研究和装置研制。此外,其大载重eVTOL曜眸MX150E无人机即将首飞量产,有望成低空经济出海冠军。

AI科技评论
算法论文8

VLM 实现 10%的精度提高,13.1倍加速!纽约大学新算法让视觉语言模型更小、更快、更准确

纽约大学研究团队用QSVD新方法让视觉语言模型(VLM)效率飞跃,在普通GPU上实现13.1倍加速。它将Q、K、V矩阵捆绑处理,设计秩分配策略,引入量化方案,经多模型评估,展现出低硬件成本、高精度优势。

AIGC开放社区
算法论文8

ICML2025 | 揭示MLLM的图文联动推理能力

当前多模态大语言模型(MLLMs)在图文深度融合推理能力上面临挑战,现有评测基准无法真正检验该能力。EMMA基准应运而生,它从四大领域精选题目,采用双重过滤机制和细粒度标注体系,评测发现MLLMs存在多模态推理危机。

深度学习自然语言处理
算法论文8

一种基于滑动层合并的高效深度修剪大模型的方法

文章指出深度修剪可加快推理速度,但直接丢层会降低性能。为此提出滑动层合并法,根据相似度阈值融合连续层,简化结构且保持性能。实验显示该方法优于现有技术,还揭示了与宽度修剪结合的潜力。

机器学习AI算法工程
产品应用7

实测飞猪 AI:真正的突围才刚刚开始?

2026年上半年,AI行业面临盈利难题,AI Coding虽火热,但旅游等领域落地AI更具挑战与潜力。飞猪升级AI能力推出「飞猪帮帮」,能办事、融合交互方式,还解决通用模型痛点,不过落地成闭环仍需供应商适配。

AI科技评论