「L3阶段」共找到 2701 篇相关文章
特斯拉们,慌了?英伟达智能驾驶实测曝光:仅用一年追平马斯克八年心血
英伟达汽车业务虽仅占总收入1%,但十年积累已成气候。其与Uber合作、推广L2级城市功能,到2028年将实现L3高速公路驾驶,仅用1年几乎追上马斯克的FSD。实测中英伟达自动驾驶表现出色,新系统也有诸多亮点。
一个Dispatch Dtype引起的fp8 quant kernel性能问题
文章记录SGLang社区在sgl-kernel中解决的fp8 quant kernel性能问题,因错误使用`c10::Float8_e4m3fn`数据类型,未用硬件加速指令,通过软件调用致性能下降,现已修复,vLLM也应用此修复。
第 3 章 Agent 核心功能技术详解
本章以Claude Code及其生态为主参照,介绍现代Agent平台提供类似‘操作系统’机制,包括命令、记忆等。面向熟悉Python与LLM的开发者,按是什么、解决什么问题等展开,还分析了Agent工程核心挑战。
仅 3MB 大小,终端极速预览 word!
开发者等常需在服务器或命令行环境查看Word文档,传统方式低效。开源神器doxx基于Rust开发,无需Microsoft Word等软件,有保留格式渲染、全文搜索等功能,还提供多种安装渠道。
暴涨3倍!光模块背后大赢家
2025年源杰科技股价表现强劲,年初迄今涨幅达348%,反超下游大客户中际旭创。其前三季度业绩爆发,得益于数据中心市场产品放量。随着AI算力需求爆发,光互连技术向CPO架构演进,对光芯片要求提高,源杰科技高端产品突破助其获利。
3.1w颗星!一条命令,克隆任意网站
此项目只需给AI编程代理一个URL,就能将网站重建成Next.js应用。介绍快速开始步骤、支持平台、前置要求、技术栈、工作原理、常用命令及项目地址等。
The Batch: 939 |在推理阶段学习长上下文
大型语言模型处理长上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练模型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。
DeepSeek-OCR 2 架构创新性能暴涨 3.73%
DeepSeek-OCR 2核心技术突破集中于DeepEncoder V2架构创新与端到端优化。如视觉Tokenizer低参高效压缩Token,LLM式视觉编码器用双流注意力驱动因果建模等,还采用三级训练流水线提升效率。
亚马逊裁员 3 万人:AI 时代的结构性裁员
多家媒体报道亚马逊计划裁减 3 万个岗位,涉及多部门,约占企业白领员工总数 10%。这或是对“疫情高峰期过度招聘”的校正,也是 AI 时代的结构性裁员,AI 投入使人工岗位减少。
2.3K Star 霸榜GitHub!DeepResearch最佳开源平替!
DeepResearch能递归拆解复杂任务自动生成报告,但OpenAI的相关产品费用高且闭源。霸榜GitHub的ROMA由Sentient AGI团队开发,性能超Grok - 4等,是开源杀手,还介绍了功能、使用方法和应用场景。