单token验证」共找到 1913 篇相关文章

产品应用8

Claude Opus 4.1 上线,SWE-bench 验证率 74.5%,重构可靠性与安全性全面升级

Anthropic推出Claude Opus 4.1,是Opus 4重要升级版。SWE - bench验证率从72.5%提至74.5%,多文件代码重构可靠性及长链交互推理能力增强,无害响应率提升,合作率下降,定价不变。

InfoQ
算法论文8

突破显存瓶颈:基于 DeepSeek-V3.2-Exp 的 Latent Cache 卸载预取方案设计与模拟验证

百度百舸AIAK团队针对DeepSeek-V3.2-Exp,设计基于Latent Cache的卸载预取方案ESS。该方案解决显存瓶颈,提升Decode吞吐并降低成本,经模拟验证效果显著,未来将拓展应用。

InfoQ
新闻资讯7

跳出英伟达生态:OpenAI 发布新编程模型 GPT-5.3-Codex-Spark,速度达 1000 token每秒

OpenAI 发布新编程模型 GPT-5.3-Codex-Spark,跑在 Cerebras 晶圆级芯片上,速度达每秒超 1000 个 token,比传统 GPU 推理快约 15 倍,这是其跳出英伟达生态的里程碑。

AGI Hunt
开源动态8

AI编程节省95% token,工具调用上限狂飙20倍,开源记忆系统登顶GitHub热榜

Claude - Mem是一款登顶GitHub热榜的持久化记忆系统,直击AI编程助手跨会话失忆痛点。它免费且省token,通过‘三层渐进式披露’架构,常规省90%,测试阶段省95%,工具调用上限提20倍。

量子位
算法论文8

NeurIPS 2025 | 北大联合小红书提出Uni-Instruct:ImageNet步生图FID进入1.0时代!

北大联合小红书提出的 Uni - Instruct 框架被 NeurIPS 2025 接收,它统一超 10 种步扩散模型蒸馏方法,在多项任务达最佳性能,还能用于文本到 3D 生成。

机器之心
开源动态8

两周复刻DeepSeek-OCR!两人小团队还原低token高压缩核心,换完解码器更实用

两人小团队仅用两周复刻DeepSeek-OCR,复刻版DeepOCR还原其低token高压缩核心优势,还在关键任务上追上原版表现。它完全开源,无需大规模算力集群,训练方案适配中小团队。

量子位
新闻资讯8

Karpathy盛赞DeepSeek-OCR“淘汰”tokenizer!实测如何用Claude Code 让新模型跑在N卡上

DeepSeek发布新模型DeepSeek - OCR,有诸多技术贡献,获Karpathy等盛赞。它或让文本token输入方式被淘汰。开发者Simon用Claude Code让其在N卡上运行成功,分享了详细过程与经验。

AI前线
新闻资讯7

35 年只卖设计,今天亲自下场造芯!Arm 首款自研芯片发布,Meta 抢下首

36 年来 Arm 一直授权芯片设计,如今推出首款自研芯片 Arm AGI CPU,Meta 成首客户。该芯片专为代理式 AI 设计,性能出众,获多家企业认可,还推出参考服务器,当前全球 CPU 供应趋紧。

AI前线
新闻资讯7

GPT-5.2被曝作弊!偷袭谷歌竟靠拉爆token刷高分,不如Gemini 3

新智元报道,OpenAI刚发布GPT - 5.2就被指「作弊」,其在基准测试中或调参数使模型用更多算力资源。有用户发现它消耗远超对手的token才获成绩,真实能力或与Gemini 3相当。此外,还揭示了OpenAI为商业利益牺牲学术独立的问题。

新智元
算法论文8

想知道你的LLM API被过度收费了吗?隐藏的Tokens终于可以被审计了

马里兰大学CASE Lab团队研究商业不透明大模型服务(COLS),定义其风险,提出三层审计蓝图。还推出验证框架CoIn,能高效识别token数量膨胀,有可定制性且审计开销低,为构建信任提供技术支撑。

机器之心