「结构化输出」共找到 1380 篇相关文章
跨层压缩隐藏状态同时加速TTFT和压缩KV cache!
论文 UNCOMP 被 EMNLP 2025 主会接收,提出高效推理框架,用截断矩阵熵解释 LLM 稀疏化,据此设计 UNCOMP 框架,通过压缩隐藏状态优化 KV Cache,实现计算与内存联合优化,实验效果显著。
DeepSeek“极你太美”bug,官方回应了
DeepSeek V3.1调用API开发时输出常现“极”字,在火山引擎、腾讯CodeBuddy等多平台出现,影响代码编译。官方称将在近版本修复,网友猜测或因数据清洗不彻底。
AI撑爆GitHub!天天宕机,18年老兵带5万星项目「决裂出逃」
GitHub第1299号用户、Vagrant之父Mitchell Hashimoto,因GitHub连续宕机和AI转型,带着5万星项目Ghostty出逃。AI让GitHub负载剧增,其资源向AI倾斜致基础设施维护变差,“去GitHub化”声音渐大。
腾讯广泛使用的跨端开发框架——Kuikly在搜狗输入法中的AI Coding实践
AI 席卷开发领域,输入法团队在 Kuikly 跨端项目探索 AI 工程化方案。介绍了推进 AI 友好型工程、构建精准 AIContext 等关键层面,以灵感词库页面开发为例展示效果,还展望了未来探索方向。
刚刚,Anthropic分享了他们在AI Agents评估的最佳实践
Anthropic发布blog《揭秘AI Agents评估》,指出良好评估能助团队信心发布AI智能体,介绍评估结构、构建原因、评估方法、从零到一的路线图,还提到评估需与其他方法配合,全面了解智能体性能。
刚刚,Anthropic新作:大模型意识被发现了
Anthropic 最新研究发现 LLM 有可被语言化报告的全局工作空间(J - space),用 Jacobian Lens 技术能读出模型思考概念、干预推理,还可暴露其未说出口的意图,为 AI 安全审计提供新途径。
3.6K Star!OpenCode 团队开源宝贝,模型价格、能力、规格一网打尽!
开发AI应用时,模型选择成难题,信息碎片化、不透明让人头疼。OpenCode团队开发的开源项目Models.dev,整合主流模型关键信息,可一站式查询、精确估算成本、对比能力,还提供公开API,社区驱动持续更新。
mem9:让微信里的龙虾不再失忆
文章介绍了 mem9 这一给 AI Agent 用的持久化记忆基础设施。它由 TiDB 团队打造,能解决 AI 失忆问题,实现记忆云端存储、无缝迁移,有两段式提取、混合搜索等功能,还能筛出重要记忆。
Claude 上线隐形水印
从上周起,Anthropic 在 Claude 模型所有文本输出中嵌入隐形水印。该水印在文本生成时织入文字,复制粘贴也保留,编辑修改可能仍在。标记机制分文本水印和文件元数据两层,全球生效。
AI 太烧钱!微软选择「倒戈」DeepSeek
微软宣布Copilot Cowork全球上线并引入按使用量计费机制,还评估引入DeepSeek V4。Agent普及使AI成本问题凸显,微软进行系统性重构,构建质量保障体系,成本工程化能力成竞争新焦点。