C2LLM」共找到 2914 篇相关文章

开源动态8

深度拆解,硬核解构,揭开vLLM推理系统实现高效吞吐的秘籍

文章深度拆解 vLLM 推理系统,介绍其核心组件和高级特性,包括推理引擎流程、调度机制、高级功能等,还提及系统扩展、分布式部署、性能测量等内容,助力读者理解推理引擎工作原理。

机器之心
推荐文章7

从私域知识到智能 Agent:构建智能运维知识库

抖音算法工程师王宁在 QCon 大会分享,介绍将私域知识与 LLM 融合构建运维系统的方法,详解 SOPAgent 架构解决传统 AIOps 难题,还提及多模态数据处理、知识管理体系等亮点。

InfoQ
新闻资讯7

00后MIT华人女生辍学创业,已融1.5个亿

00后华人女生Jessica Wu从MIT辍学,创立Sola Solutions,定位RPA界Copilot,获2100万美元融资。公司用LLM和计算机视觉构建自动化流程,已应用多行业,收入增长快。

量子位
新闻资讯7

一文看尽世界机器人大会,不用去现场人挤人了

2025世界机器人大会精彩纷呈,有200余家企业及百余款新品参展。大会分ABC三区,展示全场景覆盖与全行业应用的机器人。除展品,园区还有五大活动。文章带读者云逛展,介绍各馆特色机器人与产品。

量子位
推荐文章7

OpenAI分享了一份上下文工程实用指南。

OpenAI产品负责人Miquel联合Piotr发布Context Engineering深度指南。介绍了Context Engineering概念、6种核心上下文,指出RAG只是其中一环,还讲述信息检索的多种范式及上下文组装方法。

探索AGI
新闻资讯7

并行革命,32倍吞吐量跃升!英伟达Helix架构突破百万Token推理瓶颈

英伟达推出受DNA结构启发的Helix并行技术,能解决大模型处理长任务时的卡顿问题,提升上下文长度、并发能力并降低响应延迟。不过也有人认为其技术与实用性有差距。

新智元
开源动态8

谷歌T5Gemma重燃架构之战!「套壳」反杀Gemma本尊,9B推理快得离谱

2023年以来大模型战场由decoder - only架构主导,Google双线出击。T5Gemma重燃encoder - decoder架构战火,性能提升显著;MedGemma坚守decoder - only路线,强攻医疗多模态,击穿闭源壁垒,打响开源反击战。

新智元
新闻资讯8

semianalysis 长文 | 关于Meta 砸钱、抢人、领导力、建帐篷、计算、数据和超级智能

Meta在基础模型性能落后,扎克伯格亲自挂帅开启AI军备竞赛。他砸钱收购、挖人、堆算力,建GPU集群,还面临Llama 4失败问题,试图通过一系列举措追赶超级智能。

AGI Hunt
算法论文8

从「记忆解题」到「深度推理」:港科大推出首个本科数学动态评测基准 UGMathBench

港科大团队发表在 ICLR 2025 的研究 UGMathBench,是首个本科数学动态评测体系。它涵盖 16 个学科领域,通过变量扰动创建多版本试题,引入创新指标评估模型推理能力,测试结果揭示了当前模型短板。

AI科技大本营
新闻资讯8

领先于Transformer!新架构首个1200万上下文模型SubQ,成本仅Opus的5%

Subquadratic公司提出SubQ模型,核心是SSA亚二次稀疏注意力机制。该机制改变注意力计算分配,让模型真正读长文档。SubQ是首个有1200万token上下文窗口的前沿模型,成本低、速度快,有望革新大模型扩展路径。

机器之心