Blackwell B200」共找到 939 篇相关文章

产品应用8

Claude Code 最佳实践:从「能用」到「用得好」的 15 个关键技巧

GitHub热门仓库‘claude - code - best - practice’拆透Claude Code用法。本文提炼其精华,结合经验给出实操指南,涵盖上下文管理、CLAUDE.md设置、子代理等15个关键技巧,助你用好Claude Code。

AI Reading Hub
开源动态7

DeepSeek悄悄更新:Mega MoE、FP4 Indexer来了

昨天下午,DeepSeek 更新了 DeepGEMM 代码库,带来新东西 Mega MoE。它将 MoE 计算流程整合,让数据通信和计算同时发生,提高 GPU 利用率。还尝试组合精度、搞 FP4 indexer 等,是基础设施层重构尝试。

机器之心
开源动态8

AI智能体也有「蜘蛛感应」,防御延时骤降至8.3%

传统Agent防御机制易致延时积累,研究者联合推出Spider - Sense智能体防御框架,利用两大核心技术将防御延时从200% + 降至8.3%,在主流数据集和新基准测试中表现优异。

新智元
产品应用7

APP 上线 40 天后,Sora 核心团队分享了他们对于 AI 社交的关键思考

Sora APP上线不到5天下载达100万次,近200万周活用户中70%在创作。其核心团队分享对AI社交思考,介绍玩法、设计理念,还谈及推荐算法、创作门槛、商业化等方面规划。

Founder Park
算法论文8

让VLM学会「心中有世界」:VAGEN用多轮RL把视觉智能变成「世界模型」推理机器

当前VLM智能体面对复杂视觉任务表现不佳,美国西北大学等机构联合研究成果VAGEN,提出创新强化学习框架,奖励正确思考过程,让VLM在行动前构建内部世界模型,效果超多款闭源大模型。

机器之心
产品应用8

首创双NPU架构一鸣惊人!联发科天玑9500重磅加码主动式AI体验

联发科天玑9500首创超性能+超能效双NPU架构,让AI始终在线,融入用户操作。其输出性能、上下文窗口等有显著提升,还解决了模型加载慢等问题,与多厂商合作推动端侧AI落地。

量子位
推荐文章7

当面试官说「回去等通知」时,他们到底在等什么?

Chip Huyen的开源书《Machine Learning Interviews》被热议,其用200+道题拆解机器学习面试真相,指出多数人挂在三环节。书还摊开不同岗位考察点,建议关注解题路径,还给出资源指路。

AI工程化
推荐文章7

Qwen2.5VL新玩法,看电影讲故事

本公众号关注AI前沿技术,分享实战案例与课程。介绍视觉叙事技术及挑战,基于Qwen2.5 - VL 7B模型微调Qwen Storyteller,构建StoryReasoning数据集,还给出实战代码及相关链接。

CourseAI
推荐文章7

CUTLASS CuTe GEMM细节分析(一)——ldmatrix的选择

作者作为CUTLASS CuTe初学者,记录问题分析过程。本文聚焦如何基于TiledMMA及输入矩阵在Shared Memory上的Layout选合适Copy Operation完成拷贝,结合实例讲解ldmatrix指令选择,还给出参考代码。

GiantPandaLLM
算法论文8

CoT推理大溃败?哈佛华人揭秘:LLM一思考,立刻就「失智」

新研究揭示思维链CoT会分散模型「注意力」,使大模型推理时易出错。研究指出在需遵守指令任务中,用CoT推理模型准确率下降,还总结了四大模式,并提出四种缓解策略。

新智元