1.5B模型」共找到 9073 篇相关文章

新闻资讯7

商汤医疗再获超5亿元融资,估值突破10亿美元

商汤医疗年初完成超5亿战略融资,估值破10亿美元。其走医疗世界模型路线,构建独特产品迭代体系,与超500家医院、多家药企及器械企业合作,推进全球化布局。

量子位
产品应用8

华为曝光两大黑科技!打破推理延迟魔咒,大模型从此「秒回」

华为通过FusionSpec和OptiQuant两大技术创新,对MoE模型进行推理优化。FusionSpec依托昇腾特点,将投机推理框架耗时降至1ms;OptiQuant支持灵活量化,为大模型推理提供高性价比。

新智元
开源动态8

没想到,最Open的开源新模型,来自小红书

向来低调的小红书昨日开源首个自研大模型 dots.llm1,它是中等规模的 MoE 模型,在较小激活量下性能良好。其开源力度堪称行业最大,还介绍了数据处理、训练优化等多方面技术细节。

机器之心
开源动态8

Issue修复开源No.1!蚂蚁 | 提出代码图模型:CGM,结合GraphRAG架构,领先最强开源7.33%

为解决开源模型在仓库级代码理解上的能力瓶颈,蚂蚁全模态代码算法团队提出 CGM 架构,融合仓库结构与语义信息。CGM 首创图结构与语言模型融合的对齐框架,还搭配了 GraphRAG 框架,在多个代码任务中表现出色,且相关资源均已开源。

AINLPer
开源动态8

商汤科技与南洋理工大开源空间智能多模态SOTA模型

商汤科技与南洋理工大学构建800万量级三维空间数据集,训练出开源SOTA多模态基础模型SenseNova - SI系列。该系列模型在多个权威测试中表现出色,部分超越GPT - 5,还展现出泛化等能力,且能赋能具身智能。

AIGC开放社区
算法论文8

推理正确率下降65.5%!斯坦福、MIT等用「不等式」拷问AI逻辑极限

大语言模型在数学证明常现推理漏洞,斯坦福等高校团队提出IneqMath基准评估其严谨性。用不等式证明题切入,拆解为子任务,构建评测体系,用LLM - as - Judge审查。结果显示模型推理正确率低,存在结构性缺陷。

新智元
算法论文8

规范对齐时代:GPT-5 断层领先,让安全与行为边界更明晰

上海交通大学等团队提出规范对齐概念,构建评测基准 SpecBench 评测 33 个主流模型,发现多数模型有不足。还探索测试时深思方法,如 Align3 能提升规范遵循度,GPT - 5 在规范对齐上断层领先。

机器之心
开源动态8

离GPT-5最近的一次!中国1万亿参数开源巨兽突然爆火

月之暗面发布全新模型Kimi K2 Thinking,自称开源「思考Agent模型」。它参数约1万亿,性能亮眼,碾压GPT - 5等,能连续调200 - 300次工具,已上线并开源API和权重,开发者可试用。

新智元
开源动态7

智普入局OCR! GLM-OCR 0.9B 也杀进来了~

OCR是上古任务,如今大模型纷纷入局,用1B以下小参数模型搅动解析市场。GLM-OCR能做文本识别等,采用三级架构,有两阶段流水线及训练机制创新,在多场景表现出色。

CourseAI
算法论文8

苹果再发论文:精准定位LLM幻觉,GPT-5、o3都办不到

近日苹果发布重磅论文,提出 RL4HS 方法,用强化学习训练模型,能准确标出答案中幻觉部分,还使用片段级奖励和类别感知的 GRPO,在片段级幻觉检测任务上超 GPT - 5 和 o3。

机器之心