Token向量化」共找到 1436 篇相关文章

新闻资讯8

杨植麟当主持人的大模型圆桌:张鹏罗福莉夏立雪都放开说了

中关村论坛上,杨植麟、罗福莉、张鹏、夏立雪、黄超齐聚,共论agent的下一代演进。各位大咖观点硬核,如罗福莉认为中国大模型团队优势在‘算力受限下的最优解能力’,张鹏解释智谱新模型涨价原因等。

量子位
开源动态8

MiniMax-M1:全球首个开源超长上下文大模型,超越DeepSeek-R1,推理成本仅1/4

MiniMax-M1是全球首个开源超长上下文大模型,刷新三项记录。它采用混合专家架构,闪电注意力让推理复杂度近乎线性增长。CISPO算法加速训练,成本低。在工业级任务测试表现佳,已开源且方便开发者接入。

深度学习自然语言处理
产品应用7

1.93bit版DeepSeek-R1编程超过Claude 4 Sonnet,不用GPU也能运行

1.93bit量化后的DeepSeek - R1(0528)编程能力超Claude 4 Sonnet,在aider榜单获60分。Unsloth工作室制作9个量化版本,小版本不用GPU也能跑。R1 - 0528在游戏评测中表现也佳。

量子位
开源动态8

超长推理还能节省计算!Salesforce开源神器两连发:教大模型边想边省,显著提升数学编程准确率

Salesforce AI Research开源Elastic Reasoning和Fractured Sampling。前者将推理流程分两部分,分配token预算,使输出缩短、准确性提高;后者打碎推理链条,从三维度采样,以更少tokens换更高准确率,均提升数学和编程任务准确率。

量子位
开源动态8

解码加速15倍!EdgeRazor助推大模型在PC/移动端“狂飙”

大语言模型参数膨胀,端侧部署难,量化成主流轻量化方案。开源工具库EdgeRazor由南京大学和微软联合推出,采用MPQAD打破极低比特大语言模型“能力塌陷”,在性能、效率、易用性等方面表现出色,打通AI全生态链路。

机器之心
开源动态7

像原始人一样和AI对话,费用可直接砍掉40%

开源项目‘caveman-compression’能帮使用ChatGPT API或其他大模型的用户省钱。原理是删废话留关键信息,有调用OpenAI和本地NLP两种压缩方式,不同场景省钱效果不同,还介绍了使用方法。

AI工程化
算法论文8

转载 | 赖姜研究员等:基于人工智能的结构力学专题序

基于人工智能的结构力学研究因多领域融合取得进展,突破传统瓶颈。《力学学报》组织专题含6篇论文,展示我国科研人员在该领域结合的最新成果,多位专家参与,介绍了专题相关研究及期刊信息。

力学与人工智能
开源动态8

3万小时触觉数据补齐具身智能“手感”!新智具身&复旦大学技术报告三连发

上海新智具身联合复旦发布三份技术报告,将触觉跃升为具身智能核心基建。包含统一触觉数据格式并构建3万小时语料库、以触觉预判赋能VLA、在世界模型重构触觉想象等内容,项目数据和模型将开源。

量子位
产品应用7

人形机器人终于学会洗碗了

Figure机器人学会洗碗,用的是叠毛巾和分包裹同款Helix架构,无新算法和特殊工程,仅增加新数据。该架构是端到端“视觉 - 语言 - 动作”模型,同一系统增数据就能学新技能。

量子位
新闻资讯8

ChatGPT默认模型大升级,GPT-5.5 Instant正式上线:新增记忆来源功能

OpenAI宣布ChatGPT默认模型升级为GPT-5.5 Instant,面所有用户开放。升级核心是准确性,在高风险领域幻觉内容减少,能力全面提升,回复更简洁。还提升了个性化能力,引入记忆来源功能。

AI寒武纪