豆包大模型1.8」共找到 8620 篇相关文章

算法论文8

RL训练总崩溃?R1-Reward稳定解锁奖励模型Long-Cot推理能力

多模态奖励模型对提升多模态大语言模型表现至关重要,但强化学习在奖励建模应用有挑战。快手等团队提出R1 - Reward,解决训练不稳定等问题,在基准上超SOTA模型,还在快手业务场景成功应用。

机器之心
开源动态8

快手Klear-Reasoner登顶8B模型榜首,GPPO算法双效强化稳定性与探索能力!

快手Klear团队推出Klear-Reasoner模型,基于Qwen3 - 8B - Base打造,在多基准测试达同规模SOTA。其核心GPPO算法能强化稳定性与探索能力,团队还对训练流程多环节深入分析,给出优化策略。

AI前线
开源动态8

杨植麟被梁文锋叫醒了!Kimi新模型发布即开源,1T参数全线SOTA

172天后,Kimi推出全新Kimi K2基础大模型回应DeepSeek冲击。它为MoE架构,1T参数,激活参数32B,在多任务上领先,发布即开源,还分享技术细节,实测有亮点也待优化,展现回归之势。

量子位
新闻资讯8

浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型

2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek - R1 - Safe基础大模型,提升了我国AI系统自主安全防控水平,任奎获“科研创新卓越贡献奖”。

AI大模型应用实践
产品应用8

文心X1.1发布!这三大能力突出,一手实测在此

百度深度思考模型文心X1.1升级上线,在事实性、指令遵循、智能体等能力显著提升,实测表现佳。WAVE SUMMIT 2025大会还发布开源模型ERNIE - 4.5 - 21B - A3B - Thinking等,飞桨框架也升级到v3.2。

量子位
算法论文8

华为中科大联创大模型低比特量化算法,1‰数据实现昇腾无损压缩7倍

华为诺亚方舟实验室联合中科大提出CBQ后训练量化方案,仅用0.1%训练数据实现大模型7倍压缩,保留99%精度。该成果登ICLR 2025 Spotlight,已加入昇腾ModelSlim工具包。

新智元
开源动态8

最强大脑组合!全球SOTA的逻辑和记忆CodeBrain-1&MemBrain1.5同时开源

世界模型初创公司Feeling AI正式发布并开源MemBrain1.5和CodeBrain-1,终结AI“无状态”工具时代。CodeBrain提升模型操作成功率、降低成本,MemBrain重构记忆系统,二者助力Agent能力升级。

机器之心
产品应用8

豆包模型 Seed 2.0,有点不一样

模型升级频繁令人审美疲劳,但豆包模型Seed 2.0不同,其核心是Skills调用能力。作者测试了它做的小红书长图文排版生成器和古文翻译器,还体验了APP“专家模式”,展现多模态理解优势。

刘言飞语
新闻资讯7

全网爆火的DeepSeek「UE8M0 FP8」,原来英伟达早已支持

NVIDIA PTX ISA文档早有.ue8m0数据类型,UE8M0 fp8并非DeepSeek独创。从PTX 8.0/9.0起,NVIDIA在ISA级别支持.ue8m0,H100、RTX 40系列等都有相关支持,DeepSeek是将其提升到模型层面。

AI寒武纪
开源动态8

开源版Genie 3世界模型来了:实时+长时间交互,单卡可跑,国内公司出品

本月初 Google DeepMind 发布 Genie 3 引发关注,没过两周昆仑万维就推出开源交互世界模型 Matrix - Game 2.0,参数量 1.8B,单卡可跑,能实现实时长序列、交互式生成,经测试潜力大。

机器之心