观测的暴露度」共找到 10611 篇相关文章

推荐文章8

GPU-MODE Leaderboards之nvfp4_gemv代码阅读

文章围绕GPU-MODEnvfp4_gemv竞赛rank1代码展开,先介绍问题及官方baseline,后详细解读rank1代码,含数据加载、线程模型等,还剖析核心计算函数,最后总结代码在缓存控制、数据格式等方面调优亮点。

GiantPandaLLM
算法论文8

Shopee OnePiece:业内首个融合上下文工程、隐式推理和多目标训练策略生成式搜推建模框架

2025年生成式推荐发展火热,但工业界落地多在序列化建模,替换传统范式遇阻。Shopee傅聪团队联合人大高瓴学院提出OnePiece范式,是业内首个融合多策略生成式搜推建模框架,含上下文工程、隐式推理和多目标训练策略。

InfoQ
开源动态8

腾讯发布混元3D世界模型1.0:首个支持物理仿真开源世界生成系统

在2025年世界人工智能大会上,腾讯发布混元3D世界模型1.0,它是首个开源且兼容传统CG管线可漫游世界生成模型。可通过文图生成3D世界,支持编辑、仿真,有360°沉浸、工业兼容、原子级交互优势。

量子位
开源动态8

小红书hi lab首次开源文本大模型,训练资源不到Qwen2.5 72B 四分之一

6月6日,小红书hi lab团队首次开源文本大模型dots.llm1,采用MIT许可证。该模型激活参数量140亿,总参数量1420亿,上下文长度32K。训练资源不到Qwen2.5 72B四分之一,在多个测评中表现出色。

AI前线
开源动态9

SGLang DeepSeek-V4.1 Flash Day 0 优化实录:4×B300 上 BS=1 达到 764 tokens/s

本文是SGLang团队DeepSeek-V4.1 Flash Day 0优化实录,详解了架构适配、KV cache压缩、kernel优化到DSpark适配全流程,公开4×B300 GPU实测吞吐数据,附复现代码与步骤

GiantPandaLLM
新闻资讯8

Anthropic 深夜祭出 Claude Sonnet 4.5,能自主连续工作 30 小时!CEO:它更像你同事

昨夜凌晨,Anthropic 推出新一代模型 Claude Sonnet 4.5,官方称其是世界上最好编码模型等。它能自主连续工作 30 小时,还同步推出多项产品功能更新及 Claude Agent SDK 开发工具包。

AI前线
开源动态8

我去,Github 51k star,没看错,他是开源,“用 Docker 运行 macOS”?你绝对没看错!

这是一个运行于 Docker 中 macOS 虚拟环境项目。开发者或安全研究者在非 macOS 平台运行 macOS 常遇性能差等痛点,而 Docker - OSX 利用容器化轻量部署,接近原生性能,功能亮点多,应用场景丰富。

小华同学ai
开源动态8

9B“小”模型干了票“大”:性能超8倍参数模型,拿下23项SOTA | 智谱开源

智谱发布并开源仅9B大小模型GLM-4.1V-9B-Thinking,在28项评测中拿下23个SOTA,成10B级别最佳VLM模型。它引入思维链推理机制,通过课程采样强化学习提升能力,还获10亿投资。

量子位
新闻资讯7

亚马逊云科技大中华区总裁储瑞松:企业实现 Agentic AI 价值关键在于三大技术准备

亚马逊云科技大中华区总裁储瑞松在峰会表示,正处 Agentic AI 爆发前夜。其爆发源于大模型能力发展、协议出现、推理成本降低等因素。企业实现其价值需做好三大技术准备,还推荐了 6 月 27 - 28 日 AICon 北京站活动。

AI前线
新闻资讯7

DeepSeek一句话让国产芯片集体暴涨!背后UE8M0 FP8到底是个啥

DeepSeek V3.1发布后,官方留言提及新架构和下一代国产芯片,引发AI圈轰动,国产芯片企业股价上涨。文章介绍了UE8M0 FP8概念,分析其适配国产芯片原因,还猜测适配芯片厂商,指出代表国产AI走向软硬协同。

量子位