Token设计」共找到 1909 篇相关文章

产品应用8

国内首次!8.9毫秒推理速度破纪录,1元打穿百万token

在2025人工智能计算大会上,浪潮信息发布元脑SD200和元脑HC1000两款AI服务器。前者让DeepSeek R1的Token生成速度达8.9毫秒,后者将推理成本降至1元/百万Token,解决了AI智能体速度与成本难题。

新智元
产品应用7

从需求到设计到代码,一个软件全搞定!TRAE Work Design实测来了

TRAE Work上新Design模式,与Work、Code模式配合,实现需求、设计、代码全链路在一个平台跑通。它能识别提取设计系统,提供多种改图方式,且出图合规、改图顺手,还简化了工作流。

量子位
开源动态8

设计师的 Cursor”!拖拖拽拽就能做前端,AI 实时生成代码,代码设计双向同步!

Onlook是号称‘设计师的Cursor’的开源工具,可让用户在浏览器可视化构建前端界面,通过AI驱动双向绑定实现设计与代码实时同步,还具备多项核心功能,适用于多种场景,解决设计与开发痛点。

开源星探
新闻资讯7

DeepSeek-V3.2巨「吃」Token,竟然是被GRPO背刺了

DeepSeek-V3.2发布后引起关注,但长思考版本暴露出Token使用效率不佳问题,消耗远超同类模型。这或与GRPO算法缺陷有关,其目标函数存在长度和难度偏置,长度偏置仍是该版本高Token消耗的原因。

机器之心
新闻资讯8

重磅!OpenAI联合苹果传奇设计大佬Jony Ive官宣新公司「io」:剑指全新AI交互硬件

半小时前OpenAI官网宣布,苹果前首席设计官Jony Ive与OpenAI CEO Sam Altman联手打造新公司「io」,旨在革新与AI交互方式。两年前双方已开始合作,如今「io」并入OpenAI,Jony Ive主导设计

AI寒武纪
推荐文章7

精打细算虾养成指南: 省 Token 和把 AI 用好,从来就是一件事

文章指出用AI时Token成本高、模型变笨,原因是上下文管理不善。介绍了省Token和用好AI的方法,如按需取上下文、明确约束、多智能体协作、按阶段切换模型等,核心是在合适时间将合适上下文装入合适模型。

腾讯技术工程
开源动态8

9.7K Star 把 AI 编码的 token 消耗砍了 16 倍

当前AI编码工具默认读取整个项目文件,token消耗高。code-review-graph项目用Tree-sitter解析代码库成图,追踪改动“爆炸半径”,平均省8.2倍token,技术轻量,还能做社区检测。它揭示AI编码瓶颈在信息输入质量。

CourseAI
算法论文8

紫东太初推出GMC核心集剪枝方法,少80%Token仍满血保真多模态能力

视觉Token冗余是多模态模型高效推理与落地的瓶颈,传统筛选方法有缺陷。紫东太初团队提出GMC核心集剪枝方法,具双阶段架构,优势多,实验显示其能在减少Token同时保持性能。

量子位
开源动态7

token神器3天狂揽4.1k星!19岁小哥开发,信息无损最高省87%

一款名为caveman的省Token神器在GitHub蹿红,3天揽4.1K星。它由19岁外国小哥开发,能让Agent表达更简洁,信息无损最高省87%。不过也存在争议,如节省的多为输出Token,强迫简洁或让模型变笨。

量子位
算法论文8

EMNLP2025 | 揭开LLM训练数据中的中文污染真相,有比“您好”高2.6倍的token

近年来,大型语言模型虽成功,但训练数据易混入不良内容。论文《Speculating LLMs' Chinese Training Data Pollution from Their Tokens》探索此问题,定义PoC Token,开发PoCDetect和PoCTrace工具,揭示LLMs训练数据污染情况。

深度学习自然语言处理