多模型策略」共找到 9909 篇相关文章

开源动态8

国产类脑大模型适配国产沐曦GPU!长序列推理提速超百倍,仅用2%数据匹敌主流模型

中国科学院自动化所李国齐、徐波团队发布类脑脉冲大模型SpikingBrain (瞬悉)-1.0,借鉴大脑信息处理机制,适配国产沐曦GPU,长序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑大模型生态。

量子位
开源动态8

社区供稿 | 全能高手&科学明星,上海AI实验室开源发布『书生』科学模态大模型 Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源科学模态大模型Intern-S1。它融合书生家族优势,首创跨模态科学解析引擎,在学科任务上超越顶尖闭源模型,技术创新显著,未来将持续开源。

Hugging Face
算法论文8

解码提速15.1倍、任务性能不降:复旦&引望WAM-Diff2打通自动驾驶VLA自回归—扩散转换

视觉-语言-动作(VLA)模型是端到端自动驾驶主流技术,但自回归解码架构有瓶颈。复旦大学与引望智能联合提出WAM-Diff2,实现自回归VLA向离散扩散模型迁移,解码加速15.1倍,任务性能不降。

机器之心
产品应用8

Luma Uni-1.1 API开放,图像模型榜单第三,文字渲染直逼GPT image 2

今年图像生成模型迭代快,海外AI初创公司Luma将统一图像模型Uni - 1升级到1.1版并开放API。它在榜单排名前三,价格与延迟低,有诸品牌客户接入。展示了场景应用效果,技术路线独特,定价有优势。

机器之心
开源动态8

全能高手&科学明星,上海AI实验室开源发布『书生』科学模态大模型Intern-S1 | WAIC 2025

7月26日,上海AI实验室在WAIC 2025上发布并开源『书生』科学模态大模型Intern-S1。它首创‘跨模态科学解析引擎’,在学科专业任务基准上超越顶尖闭源模型,还具备体系化技术创新。未来将持续开源,打造更懂科学的AI助手。

GiantPandaLLM
推荐文章7

我用大模型砌“屎山雕花”:5天肝出几万行代码!产品经理的AI编程翻车记

作者作为非技术背景的产品经理,分享用大模型编程经历。先借 MCP 搭建应用,后 5 天产出大量代码却问题。经三次重构领悟协作方法,还总结沟通技巧,指出 AI 编程改变产品经理工作,未来需融合角色能力。

InfoQ
开源动态8

Issue修复开源No.1!蚂蚁 | 提出代码图模型:CGM,结合GraphRAG架构,领先最强开源7.33%

为解决开源模型在仓库级代码理解上的能力瓶颈,蚂蚁全模态代码算法团队提出 CGM 架构,融合仓库结构与语义信息。CGM 首创图结构与语言模型融合的对齐框架,还搭配了 GraphRAG 框架,在个代码任务中表现出色,且相关资源均已开源。

AINLPer
算法论文8

突破模态奖励瓶颈!中科院清华快手联合提出R1-Reward,用强化学习赋予模型长期推理能力

模态奖励模型(MRMs)对提升模态大语言模型表现至关重要,强化学习理论上可引入长期推理能力,但现有RL算法用于训练MRM会不稳定。中科院、清华等团队推出R1 - Reward模型,在模态奖励模型benchmark上有显著提升。

量子位
开源动态8

突发!字节开源 36B 模型Seed-OSS

字节跳动Seed团队开源Seed-OSS系列36B模型,用12T tokens训练,采用Apache-2.0许可证。该模型能灵活控制推理预算,有两个基座版本,Instruct版在方面表现强劲,性能碾压OpenAI开源模型

AGI Hunt
算法论文8

监督学习也能从错误中学习反思?!清华英伟达联合提出隐式负向策略爆炸提升数学能力

清华大学与英伟达、斯坦福联合提出监督学习方案NFT,在RFT算法基础上构造“隐式负向模型”利用负向数据训练。该策略弥合监督与强化学习差距,其损失函数梯度和GRPO在On - Policy条件下等价。

量子位