多轮序列决策」共找到 463 篇相关文章

新闻资讯7

Z世代生存、学习与未来宣言!伯克利学霸预言课堂,用AI设计人生

本期OpenAI播客中,USC的Yabi和伯克利分校学生分享AI使用体验。谈及教授适应AI的教学转变、‘学习模式’特点、‘作弊’新定义,还大胆设想AI完成教育授课,人类导师培养社交技能。

新智元
产品应用7

LLM加速利器LMCache,极大降低GPU资源消耗

LMCache是大语言模型服务引擎扩展组件,能降低首次响应延迟、提升吞吐量,适用于长上下文场景。它将KV缓存存于多级存储,跨服务实例复用任意重复文本的KV缓存,节省GPU算力,与vLLM结合优化显著。

GitHubStore
产品应用7

一步步实战 CopilotKit(AG-UI协议):生成式 UI 与集成 Human-in-the-Loop【下】

文章延续上篇Demo,探索CopilotKit在重要场景的应用,如基于Agent的生成式UI、HITL人类参与流程等。展示了相关实例操作步骤与前端效果,指出其为构建智能应用奠定基础,降低AI融合门槛。

AI大模型应用实践
新闻资讯8

Mamba一作预告新架构!长文论述Transformer≠最终解法

Mamba一作将演讲整合成科普长文,探讨SSMs和Transformer模型权衡之术。认为Attention非万能,Transformer是阶段性最优。几天后将发布新架构,能与Transformers兼容,还回顾了两模型特点及结合优势。

量子位
算法论文8

AI发现医生看不见的隐藏心脏病风险,近90%准确率远超人类专家|Nature子刊

登上《Nature》子刊的研究显示,约翰霍普金斯大学团队开发的多模态AI模型MAARS,用深度学习处理原始MRI图像,实现对心源性猝死风险高精度预测,准确率达89%,还能辅助制定个性化医疗方案。

量子位
算法论文8

Google | 溯源分析RAG系统错误,提出选择性生成框架,让RAG问答准确率提升10%

Google对RAG系统错误深入分析,引入‘充分上下文’概念,指出幻觉或因上下文不足。构建评估器,提出选择性生成框架,结合多信号决策,实验显示可让RAG问答准确率最高提升10%。

AINLPer
新闻资讯8

Anthropic 发布 AI-Native 软件开发流程:时代变了,该换套模式了

Anthropic 8 月 21 日发布《The AI-Native SDLC Playbook》,指出传统软件开发生命周期(SDLC)流程重,已不适应 AI 时代。介绍了 AI 原生 SDLC,把旧管控目标和新执行方式结合,还分六阶段阐述具体实践。

Founder Park
新闻资讯7

“额度想重置就重置,不问财务”,Codex Tibo首曝幕后:产品没做好,就补偿用户

围绕 Codex 与 Claude Code 使用额度问题,社区不满额度机制不透明不可预测。Codex 团队 Tibo 公开额度重置逻辑源于补偿,并非营销。此外,还谈及产品融合、技术创新、算力决策等多方面内容。

InfoQ
算法论文8

北大联合阶跃星辰提出TensorCast:统一可编程管理大模型张量,推理「首字延迟」最高降低93.2%

随着模型规模增长、新应用兴起,大模型基础设施面临管理「张量状态」挑战。北大、阶跃星辰与北邮联合提出 TensorCast,解耦张量状态,复用管理能力,在多场景测试中表现出色,为大模型基建提供新范式。

机器之心
推荐文章8

API7.ai创始人温铭:烧了几百亿Token,我用AI重写了生产级网关,总结出6条经验

API7.ai创始人温铭分享用AI重写生产级网关经验。他认为AI编码能力超资深工程师,瓶颈在人。还介绍在公司‘禁手写代码’的情况,以及AI代码审查、使用阶段等内容,最后说明重写AI网关AISIX的原因。

InfoQ