多源混合训练」共找到 2316 篇相关文章

开源动态8

能识图、看视频,也能理解软件界面:蚂蚁百灵开源Ling-3.0-flash-VL

本文介绍蚂蚁百灵开源的多模态大模型Ling-3.0-flash-VL,该模型采用稀疏混合专家架构,支持图片、视频、软件界面理解,可将视觉信息用于推理与任务执行,开放权重采用MIT许可证供开发者部署测试。

AIGC开放社区
新闻资讯8

4000 万美金新一轮融资,ACE 成为 AI 音乐赛道融资额最高的华人团队

近日,AI音乐公司ACE完成近4000万美元新一轮融资,成AI音乐赛道融资额最高的华人团队。它自己训练音乐基础模型与做应用,构建数据飞轮,还推出新消费级产品Miya,欲打造AI时代的Spotify。

Founder Park
新闻资讯7

Gemini 3.8,明日登场!

最新爆料,Gemini 3.8 Flash明日登场,谷歌已放弃Gemini 3.5 Pro。其编程实力强悍,之前还为Gemini植入智能体视频理解功能,降本提效,可应对多种高难度场景。近期多家AI发布计划撞车,混战升级。

新智元
产品应用7

调高一档推理强度,成本可能翻几倍:大模型思考原理讲清楚

文章详细讲解推理强度原理,指出其不改模型,只改草稿长度。还说明模型多思考能提高答题准确率的原因,剖析贵和慢的原因,介绍三种控制形态,并给出判断推理强度档位的框架。

AI Reading Hub
产品应用7

AI写代码终于不瞎烧钱了:边车路由让顶级性能成本直降35%

传统模型路由用于写生产代码易掉链子,Cognition发布的Devin Fusion混合模型框架可解决该问题。官方测试显示,它能降35%编码智能成本且质量无明显下滑,从实际测试案例可看出其适用边界。

AI工程化
开源动态8

小模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源

微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。

AIGC开放社区
产品应用8

AI公司烧不起Token了!国产Agent杀出,逼近Opus 4.6还免费

Token成AI时代“电力消耗”,企业成本压力大。昆仑万维推出高性能Agent模型SkyClaw - v1.0及轻量版,性能逼近顶流,价格低且限时免费。经实测能力强,其训练体系独特,未来还将开源。

新智元
推荐文章8

指导Harness的越多,收益反而越差

Thinking Machines Lab的《Interaction Models》指出,当下产品形态中,指导harness越多收益越差。问题在协作带宽,提出把“会交互”练进模型本体,介绍了从零训练的interaction model及架构,还指出现有交互评测不足。

CourseAI
算法论文8

AI安全得查祖宗三代?Anthropic登Nature揭秘大模型潜意识传染

Anthropic论文登上Nature,揭示AI模型仅通过纯数字序列就能继承另一模型的危险偏好。研究表明,即使删掉敏感词,隐性信号仍能传递,且代码和推理链也是传染通道,这对AI安全评估提出新挑战。

新智元
算法论文8

AdaGen: 让图像生成模型学会自适应策略

当前主流图像生成模型多步策略依赖手工静态调度规则,存在需大量调参、无法适配样本特性的问题。本文提出AdaGen框架,通过强化学习训练策略网络,在四大生成范式上实现性能提升与效率优化。

机器之心