大模型部署」共找到 9430 篇相关文章

开源动态8

社区供稿 | Hugging Face x 北京中关村学院等机构联合发布生成式基因组模型Carbon:一场关于“生命语言”的范式革命

北京中关村学院等联合发布生成式基因组模型Carbon并开源。Carbon家族有三个版本,旗舰模型Carbon - 3B在多任务匹敌70亿参数的Evo2 - 7B,运行速度快275倍。它在数据、分词、训练上有创新,还实现技术普惠,有多种应用场景。

Hugging Face
新闻资讯7

亚马逊云科技中华区总裁储瑞松:企业实现 Agentic AI 价值的关键在于三技术准备

亚马逊云科技中华区总裁储瑞松在峰会表示,正处 Agentic AI 爆发前夜。其爆发源于模型能力发展、协议出现、推理成本降低等因素。企业实现其价值需做好三技术准备,还推荐了 6 月 27 - 28 日的 AICon 北京站活动。

AI前线
开源动态7

宇树:开源机器人世界模型

宇树开源世界模型 - 动作架构UnifoLM - WMA - 0,它属UnifoLM系列,适配多机器人本体。真机部署表现出色,预测与实际操作吻合。官方介绍训练策略,代码开源后GitHub获100 + Star。

量子位
算法论文8

世界首个!李飞飞团队推出物理推理基准,模型统统不及格?

斯坦福联合中科团队推出世界首个评估视觉语言模型物理推理能力的基准QuantiPhy,通过测试发现顶尖模型在数值计算上不如人类,还揭示模型推理靠记忆而非测量,为AI发展指明方向。

AIGC开放社区
开源动态8

完全透明开源的共情语音模型,三阶段训练,四模块实现端到端对话 | 紫东太初联合长城汽车开源OpenS2S

GPT - 4o、Gemini等顶级语音模型闭源,紫东太初团队联合长城汽车AI Lab开源端到端共情语音语言模型OpenS2S,提供构建共情语音系统新范式,开源所有核心资源,还介绍了技术方案、数据构建及训练流程等。

量子位
推荐文章8

对话RoboScience邵林:VLOA模型如何突破具身智能泛化瓶颈

本文对话RoboScience联合创始人邵林,探讨VLOA模型突破具身智能泛化瓶颈。他介绍了模型优势、设计思路,对比VLA,还谈及范式、难点及落地场景等,强调以人中心、做有温度技术,重视模型落地。

甲子光年
算法论文8

模型训练新突破!“不对称”训练让AI学会自我反思,推理零开销

字节团队提出全新语言模型训练方法PCL,首次打破训练与推理对称约束,实现‘训练-推理不对称’。在训练时让模型反思评估结果,推理时仅输出答案,零额外开销,显著提升模型能力。

量子位
推荐文章7

深刻理解Token:语言模型(LLM)是如何看待这世界?

文章指出在语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。

AINLPer
开源动态8

Memento-Skills VS OpenClaw 不改模型也能进化

Memento - Skills让AI Agent自己设计自己,通过部署时学习进化,不动模型参数,将经验写进技能库。经测试,在HLE和GAIA基准测试中准确率幅提升,与OpenClaw等定位不同,有多种部署方式,不绑定模型

CourseAI
算法论文8

模型长脑子了?研究发现LLM中层会自发模拟人脑进化

帝国理工学院等机构研究人员发表论文,指出型语言模型(LLM)学习中会自发演化出类似生物脑的协同核心结构。研究对多个模型剖析,揭示其内部处理规律,为模型可解释性开辟新路径。

机器之心