大模型榜单」共找到 9258 篇相关文章

开源动态8

小米开源首个跨域具身基座模型MiMo-Embodied,29个单SOTA

小米具身智能团队开源跨域基座模型MiMo - Embodied,它融合自动驾驶与具身智能,在29个单创SOTA。该模型基于MiMo - VL架构,采用四阶段训练策略,有效解决领域割裂问题,为通用VLA模型奠定基础。

机器之心
新闻资讯7

2025 AI Cloud 100 China单发布:6个赛道,34家新上,DeepSeek、Manus上

6月22日,靖亚资本等发布2025 AI Cloud 100 China单,聚焦GenAI商业落地企业。还发布行业趋势报告,总结融资、技术等情况,预测未来五趋势,如AI应用从Copilot升级到Autopilot等。

Founder Park
算法论文8

精准调控模型生成与推理!浙&腾讯新方法尝试为其注入“行为定向剂”

ACL 2025中选论文里,浙与腾讯联合团队提出STA方法,深入模型内部分析神经元激活模式,干预关键神经元,抑制有害行为、保留通用性能,还在多模型实验验证效果,并将部分方法开源。

量子位
推荐文章8

揭秘模型Steering:从底层机理到系统评估,全面破解模型行为控制之谜

近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。

机器之心
开源动态8

6.1B激活,三开源第一!蚂蚁·安诊儿医疗模型发布

由浙江省卫生健康信息中心等联合研发的开源医疗语言模型AntAngelMed发布。它基于Ling - flash - 2.0,100B总参数仅激活6.1B达约40B密集模型性能,在多个权威医疗基准测评中居前列,采用三阶段训练流程,高效MoE架构。

AIGC开放社区
算法论文8

检索做,生成做轻:CMU团队系统评测RAG的语料与模型权衡

CMU团队在最新ECIR接收论文中,系统评估RAG语料规模与生成模型规模替代关系。实验表明,语料扩容可让小模型追上模型,提升主要来自证据覆盖。研究为RAG系统提供更具性价比提升路径。

机器之心
开源动态8

百度开源文心4.5系列10款模型,多项评测结果超DeepSeek-V3

今日百度正式开源文心模型4.5系列10款模型,涵盖不同参数规模。该系列模型在多文本和多模态基准测试达SOTA,多项评测超Qwen3、DeepSeek - V3,还具备三关键创新,获开发者关注。

Founder Park
开源动态8

群核科技开源两款空间模型,想解决 Genie3 没能彻底解决的问题

2025年8月25日群核科技举办TechDay,发布专注3D室内场景的空间模型,开源SpatialLM 1.5和SpatialGen。两款模型分别解决理解交互和空间一致性问题,有实际应用价值,还介绍了数据飞轮效应及模型相关问答。

Founder Park
新闻资讯8

9位顶级研究员连讲3晚,华为盘古模型底层研究揭秘

华为诺亚方舟实验室成果颇丰,4月开发千亿级通用语言模型Pangu Ultra,5月推出稀疏语言模型Pangu Ultra MoE。5月28 - 30日,机器之心联合举办分享会,9位研究员揭秘量化、剪枝等关键技术突破。

机器之心
推荐文章7

快速理解热门LLM语言模型

本文用通俗易懂方式帮读者理解LLM、Transformer、Prompt等基本概念,介绍模型API使用,如温度参数、角色设定等,还提及Function Calling、Agent、MCP等内容,并对AI未来发展作出假想。

腾讯技术工程