「Token调用量」共找到 1509 篇相关文章
Github斩获1.8K 星!!再见了按键精灵,Windows-MCP开源了!
今天介绍超酷开源项目Windows - MCP,它让AI与Windows系统互动,支持Win7到Win11。功能强大,不挑大模型,工具全、轻量开源、扩展性强。还给出安装步骤,不过使用时要谨慎。
何恺明评审,谢赛宁获奖!牛津华人博士生拿下CVPR 2025最佳论文
CVPR 2025奖项揭晓,投稿量增13%,接收率22.1%。最佳论文来自牛津与Meta AI,提出新前馈网络。还公布年轻研究者等多奖项,何恺明任最佳论文评审。
85倍速度碾压:苹果开源FastVLM,能在iphone直接运行的视觉语言模型
苹果开源能在 iPhone 上运行的视觉语言模型 FastVLM,代码仓库含 iOS/macOS 演示应用。它速度快,首个 token 输出速度较同类模型提升 85 倍,还兼容主流 LLM,适合边缘设备等场景。
开发边界消失是必然,但 AI 没有替代开发者!对话 Google 全球开发者生态总监 David McLaughlin
文章是对 Google 全球开发者生态总监 David McLaughlin 的访谈。谈到 AI 会让开发边界消失,开发者应转变思维,AI 增强而非替代开发者,还探讨了谷歌工具策略、开发者出海问题、Token 管理等。
GLM-5.3你来定!智谱唐杰全球征集意见,评论区清一色:视觉
清华教授、智谱唐杰在𝕏征集GLM下个版本意见,浏览量达40w+。此前他有求必应,网友热情参与。这次评论区多要视觉能力,因GLM-5.2是纯文本模型,而对手多为多模态。
"Slop"当选年度词汇:AI垃圾内容有了正式名分
韦氏词典宣布“slop”当选2025年度词汇,指AI生成的低质量数字内容。过去一年它频繁用于形容AI内容,如今AI生成网络文章占比超50%,还催生“slop经济”,但AI内容或优胜劣汰。
vLLM 正式支持 PaddleOCR-VL
11月4日,vLLM项目宣布正式支持PaddleOCR-VL模型。该模型专注文档解析,参数量仅0.9B。合作降低部署门槛,推理效率更高,官方还给出部署指南和配置建议,流程快速完成可作榜样。
OpenAI主攻速度的第一个模型来了:GPT‑5.3‑Codex‑Spark
OpenAI发布GPT-5.3-Codex-Spark,是GPT-5.3-Codex轻量级版本,也是首个为实时编程设计的模型。亮点是速度快,推理超每秒1000 token,已向ChatGPT Pro用户开放,后续规划融合两种工作模式。
GenEnv:智能体与环境模拟器之间的难度对齐协同进化 | 直播预约
训练高性能 LLM 智能体受限于真实世界交互数据的成本和特性,为此推出 GenEnv 框架,它建立难度对齐协同进化博弈,能让智能体表现提升,减少数据使用量,为扩展能力提供数据高效路径。
阿里又上好货了!Qwen3-TTS能力大幅提升
阿里刚发布Qwen3-TTS(2025-11-27版),解决语音合成核心问题。它音色大幅扩展,有49种高品质音色;语言和方言能力提升,支持10种主流语言与多种方言;韵律和语速优化,拟人化近真人;API调用简单。