大模型成本」共找到 9709 篇相关文章

新闻资讯7

全球开源模型,前十五名全是中国的

近日,随着新一代语言模型更新,开源模型成热门话题。Design Arena排行榜上,若设定为“开源”,前15名均为国产开源模型,排名第一的是DeepSeek - R1 - 0528 ,智谱、阿里等厂商多款模型上榜。

机器之心
开源动态8

成本不到8千美元!新浪微博1.5B小模型超越近万亿参数模型

新浪微博开源的VibeThinker - 1.5B模型,仅15亿参数、训练成本不足8000美元,却在顶级数学竞赛基准击败近万亿参数模型。它采用频谱到信号原则,分两阶段训练,性能出色,成本低且数据无污染。

AIGC开放社区
产品应用8

Kubernetes环境中作业帮模型服务流量调度优化实践

随着语言模型应用渐广,Kubernetes 现有 Ingress 组件在模型服务流量管理上有局限。作业帮提出创新调度方案,整合成模型网关,具备五项核心功能,提升了资源效率、稳定性和易用性。

InfoQ
产品应用7

突袭Cursor,Windsurf抢发自研模型!性能比肩Claude 3.5、但成本更低,网友好评:响应快、不废话

当地时间5月16日,Windsurf推出首个AI软件工程模型家族SWE - 1。此系列含三款模型,性能比肩Claude 3.5且成本更低。开发者试用评价不错,但也指出存在幻觉问题。Windsurf旨在提升软件开发速度,后续将持续投入。

InfoQ
推荐文章7

C端热战,B端暗涌:模型真正的战场才刚刚开始 | 《中国模型落地应用研究报告 2025》正式发布

InfoQ研究中心联合中欧AI与管理创新研究中心发布《中国模型落地应用研究报告2025》,从驱动因素、C端产品现状到B端落地现状,勾勒模型应用转折期的图景,分析应用难的原因及各端现状。

InfoQ
算法论文8

ICML 2026 | 模型内部也会长出「情绪树」,规模越越懂人心

ICML2026 论文指出,语言模型内部会自然形成类似人类心理学模型的「情绪树」,模型,情绪树越复杂,且在销售等任务上表现更好。同时,模型的情绪结构受身份设定影响,存在与人类相似的情绪识别偏见。

机器之心
算法论文8

模型思考装上“猎鹰重装引擎” :腾讯混元 SEAT 重塑深度思考

本文深度解析腾讯混元最新发布的 SEAT 自适应并行扩展推理框架。它让模型 CoT 升级,应对复杂推理任务。该框架通过多轮并行推理和语义熵导航,解决模型深度思考的局限,且适配多种模型,性价比高。

AI科技大本营
推荐文章8

万字长文!模型(LLM)推理优化技术总结(非常详细)

文章聚焦模型推理优化技术,介绍推理过程分预填充与解码阶段,还阐述模型并行、注意力机制优化、模型优化及服务技术等,如多查询注意力减少内存,FlashAttention 优化计算顺序。

AINLPer
新闻资讯8

云计算一哥首度牵手OpenAI,模型「选择」自由,才是终极胜利

亚马逊云科技宣布通过两平台支持OpenAI新开源模型,还上线Anthropic最新模型Claude Opus 4.1。其早有战略布局,两平台汇聚400+模型,践行‘选择于一切’理念,满足多样需求,打造AI生态。

机器之心
新闻资讯7

亚马逊发布新AI模型,部署机器人突破100万

全球电商、云计算巨头亚马逊宣布推出新AI基础模型Deep Fleet,部署机器人超100万。该模型可提升机器人车队出行效率,还能协调机器人移动,带来交付快、成本低等好处。

AIGC开放社区