「责任链」共找到 367 篇相关文章
PDL 在 SGLang Kimi K3 中的应用
文章介绍 PDL 在 SGLang Kimi K3 中的应用,K3 内核优化接入 PDL 以缩短相邻内核间隙。分析 PDL 原理、在 bs=1 decode 中解决的问题,阐述计算链和通信链上的应用,还提及性能数据和实现问题。
英伟达帮你省钱,让大模型推理「短而精」,速度快5倍
过去大模型推理追求长链思维,导致推理链长、Token消耗大、响应慢。英伟达研究院的DLER研究给出解决办法,通过强化学习优化方法让模型‘短而精’,推理长度减超70%且准确率不变,还适用于大模型。
开源如何促进平台构建过程中的协作
在KubeCon & CloudNativeCon欧洲大会上,Marcy Paramonova和Stéphane Cusin发表演讲指出平台是协作系统,需共同标准。开源提供共享标准与统一语言,还谈到赢得信任、文化转变等方面举措。
刚刚,Anthropic联合创始人在梵蒂冈讲了什么?
教皇发布人工智能通谕,Anthropic联合创始人Chris Olah受邀发言。他指出实验室激励与正确行事有冲突,描述了AI模型特点,还提出教会应发声的三个问题,引发社区不同反应。
连Karpathy都怕了!9千万级AI包被投毒,竟靠黑客写出bug救命
3月24日,AI应用核心工具LiteLLM更新版本含恶意代码,可窃取开发者核心信息。因攻击者代码有bug致机器崩溃才暴露。这引发AI基础设施信任危机,Karpathy称要减少依赖。
2025年各大厂真实面试题,抓紧上车还有机会!!!
作者小华整理 2025 年字节跳动、腾讯、阿里大厂面试真题及题解,涵盖算法、数据库、分布式等多领域,还给出记忆方法,助找工作或刷题同学备考。
你的「龙虾」真记得你吗?剑桥发布长期个性化记忆基准ATM-Bench
剑桥大学团队开源面向AI个人助理的长期记忆基准测试ATM - Bench,评估AI面对真实生活数据时能否「记住你」。实验结果不佳,专用和通用智能体系统准确率低,凸显长期个性化记忆问答难题。
The Batch: 896 | 教会模型说出真相
大型语言模型有时会隐瞒未遵守约束条件的事实。研究人员微调 GPT - 5 Thinking,使其违规时能‘自白’。通过强化学习训练,测试显示微调模型在多项评测中多能承认问题,自白机制可监控模型行为。
在上海,与4位国际大咖一起追问未来:人机协作时代,艺术何为?
在人机协作时代,艺术意义引人深思。上海一场论坛邀四位大咖探讨创作,将不可见存在转化为美学体验,跨越学科界限,思考人类创造力、责任及艺术共情作用。
科学能力太强,这个多模态推理「六边形战士」被严重低估!Intern-S1开源登顶
7月26日,上海AI实验室发布并开源「书生」科学多模态大模型Intern-S1,其多模态能力全球开源第一,文本能力比肩一流,科学能力国际领先。它开创「通专融合」新范式,重构科研生产力,引发国际关注。