「Token调用量」共找到 1514 篇相关文章
通用型产品增长停滞,垂直赛道成市场新解法丨季度AI 100数据解读
新一季度「AI 100」双榜单出炉,量子位智库分析1000+款AI产品。Web端总访问量和MAU增长停滞,头部下滑;APP端中腰部产品表现佳。Agent产品用户增长亮眼,未来桌面端和Web端定位将区分。
把20多种工具塞进一个搜索框!亲测「Agentic Search」后,我关掉了几十个浏览器标签页
秘塔AI推出Agentic Search,是“边想边搜,边搜边做”新搜索方式,能自主完成多步工具调用。作者测试其为AI笔记应用策划预热活动等场景,还测市场分析、编程学习、新媒体运营场景,虽有不足但未来可期。
大模型虽好,但恕我直言:在OCR面前,开源小模型更香
作者所在公司项目需处理大量纸质文档,起初考虑云端大模型API调用和开源大模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。
EMNLP25 | "大模型在环"技术新突破:Dial-In LLM 推动中文客服意图聚类新范式
本文提出LLM-in-the-loop意图聚类框架,以传统聚类为骨架,微调后的中文LLM做语义裁判和命名批注。在10万+真实客服通话数据集上超越基线,解决现有方法依赖词向量、缺乏可解释性、调用大模型成本高的问题。
英伟达韩松团队新作:具有后神经架构搜索的高效语言模型
英伟达韩松团队推出基于后神经架构搜索的高效语言模型Jet - Nemotron,在基准测试中表现出色,准确率与Qwen3等相当甚至更优,生成吞吐量大幅加速。模型构建经多步骤优化,代码和预训练模型将开源。
DeepSeek V3.1 把 R1 融了,一堆新活:<think>开关、动态搜索、新ToolCall ...
DeepSeek在Hugging Face悄悄发布V3.1版本,将对话和推理模型合并为混合推理模型。它有显式推理、内置搜索、简化工具调用等特性,Aider测试成绩佳且成本低,但也存在战术回避、幻觉率升高等问题。
数学编码超越O3-high,英伟达版「DeepSeek R1二代」推理模型开源~
Nvidia开源OpenReasoning-Nemotron系列模型合集,采用Qwen2.5架构,基于500万条轨迹训练。评测输出长度最高64K token,多版本刷新SOTA。其‘heavy’模式有独特能力,32B版在数学与编程基准超越O3(High)。
Cursor调价风波背后:商业逻辑与用户期待的错位
Cursor在6月16日调整Pro计划收费模式,从请求数限制改为计算量限制,虽称优化却引发用户不满。用户发现服务缩水且沟通模糊,社交媒体上一片失望愤怒声。7月4日Cursor道歉并推出补救措施,但信任修复不易。
从1000通到1.5万通,百融智能的「硅基客服」真正开始「上岗」
今年7月,一家头部物流企业和大型综合类头部券商上线百融智能的AI客服,业务量和部署规模增长显著。百融智能正战略升级,以新一代AICC智能联络技术向多行业拓展,其创始人张韶峰分享了相关思考与技术优势。
不做手机缩小版:AI 健康记录迁到手腕,要跨过哪些工程鸿沟?
文章围绕HarmonyOS的穿戴应用,如‘小卡健康’等,探讨将AI健康记录迁移到手腕面临的工程挑战。介绍了应用场景、系统能力调用,以及从接口到产品可用需解决的问题,强调要以用户体验为导向进行产品优化。