「小野肯」共找到 1017 篇相关文章
SGLang Custom AllReduce v1 与 v2 实现原理详解
文章聚焦 SGLang 里两代自定义 all-reduce 实现(v1 和 v2),前者从 vLLM 移植,后者是默认版本。详述其负载特征、前提条件、分发链、同步机制、算法及 CUDA graph 支持等内容,还对比了两代差异,并提及相关环境变量。
给机器人打工了一天,我们体验上了AI时代最魔幻的工作。
本文讲述作者公司小伙伴达达体验给具身智能做数据采集工作的经历。具身智能数据获取难,催生数据采集员岗位。达达面试顺利,工作时先觉新奇,后感手腕酸,日薪200 - 250元,凸显AI进步背后普通人的贡献。
激光雷达,命不由己
本文围绕激光雷达展开,介绍了其在辅助驾驶事故中的争议,回顾价格降逾99%历程,分析市场规模小、成本高难题及改善情况。还指出新玩家入场,如车企、Tier1和制造业老牌企业,且市场格局因大客户依赖等因素不稳定。
小白也能玩转AI视频!即梦Agent模式实测:一句话搞定插画、海报、Vlog
即梦AI新上线Agent模式,用户只需一次输入指令,就能从生图到生视频全搞定。该模式还具备AI小助手功能,能满足多种需求。它基于Seedream 4.0模型,将AI生图降至0门槛,官网现推出免费生图活动。
究竟会花落谁家?DeepSeek最新大模型瞄准了下一代国产AI芯片
近期,DeepSeek发布V3.1新模型,采用全新混合推理架构,在多任务表现上有提升。它采用UE8M0 FP8,或为国产推理芯片优化机制。国内多家厂商新一代AI芯片支持FP8,未来国产大模型或针对其专门优化。
OpenAI发布ChatGPT世代首个开源模型gpt-oss,4060Ti都能跑得动。
8月6日晚,OpenAI发布ChatGPT世代首个开源模型GPT - oss,有120B和20B两款。模型原生支持4 - bit量化,性能损失小,低配置显卡也能运行。跑分表现不错,还介绍了使用途径,虽有不足但改变开源社区格局。
1000+页PDF解析速度暴涨3倍,MinerU模式不香了
百度PaddleOCR推出HPD - Parsing小模型,文档解析速度大幅提升,是上一代最快模型的1.62倍、自身原解码方式的3.06倍。它采用层级并行解码架构,有两层并行设计,效果出色且兼容性好,还分享了优质训练方法和优化思路。
蚂蚁 | 提出代码检索/重排基准:CoREB,揭开高分榜背后的三大幻觉,现已接入MTEB
蚂蚁研究人员提出代码检索与重排评测基准CoREB,解决现有基准相关性软、数据污染、任务方向单一问题。它已集成进MTEB,收录19个模型×6个任务评测结果,为代码检索模型评估提供新基线。
超级麦吉:职场人 Vibe Working 的开源 LLM OS
文章介绍了开源项目超级麦吉,它是为职场人打造的 LLM OS,采用三层结构设计,有专业功能和完整产品矩阵。与闭源软件对比,其开源诚意足,虽有颜色和邀请码机制等小问题,但助力职场人向 Vibe Worker 转型。
CVPR史上首次!中国车厂主讲AI大模型,自动驾驶也玩Scaling Law?
世界计算机三大顶会之一CVPR 2025落幕,小鹏汽车作为唯一受邀车企,其世界基座模型负责人发表演讲分享成果。小鹏用强化学习打造‘AI大脑’,还自研‘世界模型’,从云到端全流程优化,展现中国车企在自动驾驶的创新实力。