速度与准确性」共找到 6961 篇相关文章

推荐文章8

KV-Cache 实战策略:生产环境中的分页、固定复用技术解析

在大语言模型推理场景中,KV - Cache 是平衡性能成本的核心技术,但生产环境中面临诸多问题。本文聚焦其分页、固定复用三大战术,结合原理、实践案例,为开发者提供解决方案,还探讨了未来演进方向。

CourseAI
算法论文8

SIGCOMM 2025|重新定义个性化视频体验,快手清华联合提出灵犀系统

快手清华孙立峰团队联合发表论文,提出灵犀系统,这是业界首个大规模生产环境中面向用户个性化体验的自适应视频流优化系统。该系统能解决现有方法在部署中的难题,实现个性化QoE优化。

机器之心
产品应用7

对话心光:在技术需求的十字路口,我们选择用AI温暖人心

本文是对心光创始人王禹效和徐璐的访谈。心光是笔记类AI陪伴产品,主界面简洁,功能丰富。团队回顾其发展历程,探讨技术需求关系、模型选择、用户画像等,还谈及盈利模式、创业时机及未来计划。

AI科技评论
推荐文章7

从HITL(Human In The Loop) 实践出发看Agent设计模式的对跖点

本文围绕在 ReactAgent 中引入并实践 HITL 机制展开,介绍实现方案代码设计。分析无通用人机协同时的问题,阐述 HITL 核心要点、实现效果细节,还探讨 Agent 演进工程设计模式的关联。

阿里云开发者
新闻资讯8

AICon 2025 深圳回顾:AI Agent 爆火全场,管理推理优化成新焦点

2025年8月22 - 23日,AICon全球人工智能开发应用大会在深圳落幕。70 + 嘉宾、800 + 开发者企业代表参会。AI Agent成全场焦点,企业管理议题意外走红,展示了AI深入企业核心管理的行业图景。

InfoQ
产品应用8

智谱开启狂飙模式!7倍提速,全球最快,旗舰模型即问即答

5月22日,智谱上线GLM - 5.1高速版API,输出速度达400 tokens/s,刷新全球大模型API速度纪录,比原版提速约7倍。该速度由GLM团队和TileRT团队联合打造,核心优化分三层推进,且是稳定可用的生产级能力。

AIGC开放社区
新闻资讯8

巅峰对决:最强模型GPT-5.3-CodexClaude Opus 4.6同时发布

OpenAI和Anthropic同时发布旗舰级模型GPT - 5.3 - CodexClaude Opus 4.6。前者有网络攻防自主代码修复能力,被评定为网络安全高风险;后者用自适应思考上下文压缩处理长程任务,在多领域表现出色,但二者也都存在安全风险。

AIGC开放社区
新闻资讯8

斯坦福吴佳俊「计算机思想奖」获奖演讲全文:从一张照片,逆推一个世界|IJCAI 2026

8月20日,斯坦福大学吴佳俊在IJCAI 2026发表“计算机思想奖”获奖演讲。他指出像素是表象,物理结构才是因果,提出以物理代码为桥,融合基础模型泛化力物理模拟因果性,构建视觉物理智能。

AI科技评论
新闻资讯8

2026 奇点智能技术大会上海站来袭,解码AI Agent、世界模型氛围编程等新范式

2026奇点智能技术大会·上海站4月17 - 18日召开。AI正成变革性力量,此次大会升级聚焦AI规模化落地,设十二大专题,有多位出品人演讲嘉宾带来实践经验技术洞察,还开放合作分享者申请。

AI科技大本营
新闻资讯7

大事件!天津美术学院·人工智能艺术

天津美术学院举办‘重力重塑 - 2025人工智能展演艺术工作坊’,作为新生入系‘供氧计划’,聚焦‘人工智能展演艺术’。邀请国内外20余名多领域专家,还有三场workshop,旨在探索AI背景下艺术创作更多可能。

MANA新媒体艺术站