善意的混乱」共找到 10472 篇相关文章

算法论文8

盘一盘,2017年Transformer之后,LLM领域重要论文

本文梳理2017年Transformer后LLM领域重要论文。如提出Transformer架构论文成现代AI基石;介绍GPT - 3论文确立‘大模型 + 大数据’缩放定律,引领LLM军备竞赛等。还列举各论文内容与影响。

机器之心
推荐文章8

Agent上限,可能不在模型,而在团队知识

文章记录安全中心团队搭建AI知识体系实践,指出Agent输出质量取决于知识质量,分析传统知识库问题,介绍AI时代知识库转变、目标设定、搭建步骤、知识飞轮及避坑指南,还展示建设后变化。

腾讯技术工程
7

统治AI十年Transformer,要被亲爹亲手砸碎?

5月5日旧金山辩论赛上,Transformer联合发明人Łukasz Kaiser为其作品辩护,三位挑战者指出Transformer五大死穴。Kaiser称除非新架构证明有更好scaling曲线,否则Transformer仍是主流,还给出具体辩护。

新智元
开源动态8

不到百万级,看不见 MCP 真实问题:创始人亲述这疯狂一年

本文是对 MCP 联合创作者 David Soria Parrra 访谈,回顾 MCP 从发布到成为行业事实标准历程,探讨其演进、应用、竞争对手等问题,还分享经验教训,展望未来发展方向。

AI前线
推荐文章7

普通程序员怎样转到AI方向拿到更好offer

在AI研究员拿天价offer当下,探讨普通程序员转AI方向拿更好offer方法,还介绍了AI生态五个层次,包括各层岗位、年薪及容量。

王喆的机器学习笔记
新闻资讯7

智能体记忆管理机制及其潜在风险 | 直播预约

大语言模型(LLM)智能体兴起,记忆机制是核心。本次报告将探讨记忆管理对其性能影响及潜在风险,展示缓解关键挑战策略,介绍新攻击范式,揭示安全漏洞,强调需重新审视与建模。

深度学习自然语言处理
推荐文章7

Jina AI创业复盘:AI团队Scaling Law是什么

文章是Jina AI创始人肖涵创业复盘。他率团队六年创业后将公司出售,期间两次转型,聚焦搜索底座模型。他分享创业经历、公司命名、业务调整等,还谈收购、模型竞争、未来创业方向及给创业者建议。

深度学习自然语言处理
开源动态7

本文关注vllm V1中管控模型分布式推理Executor部分,介绍其类型、Executor-Workers架构及数据传输机制,对比V0架构优势,以单机多卡MultiprocExecutor为例展开讲解,还提及不同数据量传输方式及相关代码。

猛猿
新闻资讯7

CNBC:马斯克xAI悄悄放弃了「公益公司」身份

马斯克旗下xAI在起诉OpenAI违背「非营利」承诺时,悄悄放弃公益企业法律身份。8月14日其移除章程中「考虑社会公共利益」条款,引发对其商业意图质疑。

AI工程化
开源动态8

欢迎 GPT OSS —— 来自 OpenAI 全新开放模型家族!

OpenAI推出GPT OSS开放模型家族,含117B参数gpt‑oss‑120b和21B参数gpt‑oss‑20b。采用Apache 2.0许可证,资源占用低、推理快,适多场景,已接入Hugging Face服务,还介绍了推理、部署等内容。

Hugging Face