大模型人才」共找到 9457 篇相关文章

推荐文章8

解决算力瓶颈,给多模态瘦身!Token压缩完整图谱与选型指南

给多模态模型瘦身是解决算力瓶颈的关键。Token压缩技术可剔除视觉冗余,提升训练与推理效率。北等团队剖析其全貌,给出完整图谱与选型指南,还揭示了未来演进路径。

AIGC开放社区
算法论文8

天下武功,唯快不破:LLM高效架构最新最全面综述

型语言模型虽成就辉煌,但训练成本高、推理延迟,核心问题源于Transformer架构。这篇综述论文首次系统性梳理高效LLM架构创新方案,分类七类方法,延伸至跨模态应用,为研究者提供‘效率蓝图’。

深度学习自然语言处理
新闻资讯7

微软叫停Tokenmaxxing!预算卡死,超限自负

从今年7月起,微软为各业务部门设「AI Token预算目标」,将GPT - 5.6设为内部默认模型。此前Tokenmaxxing风靡硅谷,如今厂纷纷收紧AI使用,微软是最后跟进者之一。

量子位
开源动态8

The Batch: 855 | 为智能体而生

总部位于北京的 Moonshot AI 发布 1 万亿参数的 Kimi K2 系列语言模型,包括预训练和微调版本。它输入输出能力强,架构独特,在多基准测试领先,支持工具调用,多家服务商已集成。

DeeplearningAI
算法论文8

充分激发模态协作,MokA量身打造MLLM微调新范式

当下多模态模型微调多「照搬」单模态微调策略,忽视模态差异。中国人民学和上海人工智能实验室团队提出 MokA 方法,兼顾单模态与跨模态建模,在多基座、多场景实验中显著提升性能。

机器之心
产品应用7

让小爱音箱超越「指令-响应」模式,开启真正智能交互新时代

2017年智能音箱诞生,却被困于「指令 - 响应」模式。此次Open - XiaoAI进化,接管小爱音箱“耳朵”和“嘴巴”,通过多模态模型和AI Agent释放其潜力,还给出项目运行教程等。

GitHubStore
新闻资讯7

发 token 当工资?工程师不只拿现金和期权,开始按 token 分身价了

硅谷正用 token 吸引人才,国内也有类似趋势。AI 使用成本渐成人力成本关键,token 对应算力争夺,其价格上涨,厂还想将 token 变成新价值单位,引发质疑。

InfoQ
新闻资讯7

年薪两百万研究AI精神病??Claude团队新部门火热招聘中

Claude团队启动“AI精神病学”小组,年薪两百万元招人。小组研究模型角色、动机等,来解决其诡异、失控行为。Anthropic可解释性部门有相关研究成果,网友对“AI精神病学”看法不一但前景值得期待。

量子位
新闻资讯7

6张图看清中美AI竞赛:美国领先在哪,中国优势在哪

TIME杂志文章用六张图表解析中美AI竞争,指出美国在芯片控制、模型性能和商业变现领先,中国受算力瓶颈制约,但在人才基础和能源供给有优势,特朗普新出口规则或带来转机。

AI工程化
产品应用7

秒级集群翻转、分钟级IDC故障止损 | 同程规模Elasticsearch平台架构设计与实践

在数据驱动时代,同程旅行核心业务依赖Elasticsearch,随着集群规模扩,面临对用户、运维、平台要求高的挑战。本文分享同程ES平台架构设计、解决方案与实践成果,还展望借助模型提升智能化水平。

InfoQ