PDF解析器」共找到 498 篇相关文章

新闻资讯8

杨植麟回复:Kimi K2训练用的H800!但“只花了460万美元”嘛…

月之暗面团队回应Kimi K2 Thinking训练成本,透露用英伟达H800,GPU少但利用充分。该模型凭实力与低成本引迁移潮,还引发对闭源巨头估值反思。技术上有优化创新,团队还公开答疑。

量子位
新闻资讯7

老黄自曝刚报废50亿美元显卡!亲自审查4.2万名员工薪酬,100%都加薪

黄仁勋在采访中透露报废50亿美元显卡,坚持先下单先得分配H100芯片。他亲自审查员工薪酬,称100%会加薪。认为AI是伟大“技术均衡”,天价AI合同合理,还谈及芯片保值、中美AI竞赛等话题。

新智元
算法论文8

为大模型思考装上“猎鹰重装引擎” :腾讯混元 SEAT 重塑深度思考

本文深度解析腾讯混元最新发布的 SEAT 自适应并行扩展推理框架。它让大模型 CoT 升级,应对复杂推理任务。该框架通过多轮并行推理和语义熵导航,解决大模型深度思考的局限,且适配多种大模型,性价比高。

AI科技大本营
新闻资讯7

成熟工程师1天完成调试,AI工程实践被MCP彻底颠覆?

去年11月Anthropic发布模型上下文协议(MCP),开发者社区迅速采用,AWS、GitHub、OpenAI等也已采用。MCP标准化数据和工具与AI代理的集成,简化定制化AI应用构建。采访华院计算杨小东,解析其架构、应用及商业价值。

AI前线
产品应用8

一场对话,我们细扒了下文心大模型背后的技术

信通院大模型推理能力评估中,文心X1 Turbo获最高级“4+级”。百度AI Day上,副总裁吴甜解析文心4.5 Turbo和文心X1 Turbo,从多模态、深度思考等方面介绍技术,还展示其在多场景应用成果。

量子位
产品应用8

具身智能的无本体数据,终于有了自己的「代表作」

自变量机人发布的Demo中,机人用数百条无本体数据完成化学实验。其发布的TwinDEX系统由无本体数据采集系统和机人末端执行组成,能让无本体数据获接近真机数据的训练效果,重新定义数据采集逻辑。

AI科技评论
产品应用8

波士顿动力机人进厂打工现逆天操作!3D感知+实时追踪,人类捣乱完全不带怕的

波士顿动力的Altas机人重磅升级,具备3D空间感知和实时物体追踪能力,可自主执行复杂工业任务。文章还解析其背后技术,包括2D感知、3D感知、物体位姿估计和校准等,团队未来将构建统一基础模型。

量子位
算法论文7

SGLang Custom AllReduce v1 与 v2 实现原理详解

文章聚焦 SGLang 里两代自定义 all-reduce 实现(v1 和 v2),前者从 vLLM 移植,后者是默认版本。详述其负载特征、前提条件、分发链、同步机制、算法及 CUDA graph 支持等内容,还对比了两代差异,并提及相关环境变量。

GiantPandaLLM
算法论文7

deepseek-V4算法工程技术深入浅出

文章围绕deepseek V4技术报告展开,指出当前大模型训练不充分,介绍了算法层面如混合注意力机制、模型结构优化、优化等,工程层面如细粒度专家并行、算子内核开发等,以及后训练的范式转变和领域专家网络蒸馏等内容。

Agent的潜意识
开源动态8

9.7K Star 把 AI 编码的 token 消耗砍了 16 倍

当前AI编码工具默认读取整个项目文件,token消耗高。code-review-graph项目用Tree-sitter解析代码库成图,追踪改动“爆炸半径”,平均省8.2倍token,技术轻量,还能做社区检测。它揭示AI编码瓶颈在信息输入质量。

CourseAI