达里奥·阿莫迪」共找到 1447 篇相关文章

新闻资讯7

英伟正为中国开发新AI芯片,比H20更强

路透社消息称英伟正为中国开发基于Blackwell架构的AI芯片B30A,性能超H20。虽特朗普称可能允许销售,但美监管批准未确定。英伟想下月交付样品,中美贸易中芯片供应是焦点。

AIGC开放社区
算法论文8

GPT-5刷屏吊胃口之际,英伟发出暴论:小型语言模型才是未来

英伟新论文指出,未来属于小型语言模型(SLM),挑战了智能体需用大型语言模型(LLM)的假设。SLM参数量低于100亿,有低延迟、低成本等优势,还给出从LLM到SLM迁移路线图。

AGI Hunt
开源动态8

英伟全新开源模型:三倍吞吐、单卡可跑,还拿下推理SOTA

英伟推出专为复杂推理和agnet任务打造的开源模型Llama Nemotron Super v1.5,实现SOTA表现,吞吐量提至前代3倍,可单卡高效运行。它采用NAS优化架构,经多数据集训练,现已开源。

量子位
新闻资讯7

并行革命,32倍吞吐量跃升!英伟Helix架构突破百万Token推理瓶颈

英伟推出受DNA结构启发的Helix并行技术,能解决大模型处理长任务时的卡顿问题,提升上下文长度、并发能力并降低响应延迟。不过也有人认为其技术与实用性有差距。

新智元
算法论文8

视频生成太慢?英伟、谢赛宁等发布TMD框架,实现70倍加速

大规模视频扩散模型采样效率低,应用受限。英伟联合谢赛宁等提出TMD框架,将大型视频扩散模型蒸馏为少步生成器。实验显示,TMD能实现超70倍加速,质量损失小,用户也更偏好其生成的视频。

机器之心
新闻资讯8

英伟4B小模型击败GPT-5 Pro!成本仅1/36

英伟ARC - AGI 2中,4B小模型NVARC以27.64%成绩力压GPT - 5 Pro登顶,单任务成本仅其1/36。亮点是零预训练深度学习法,还靠合成数据、测试时微调等策略。小模型特定领域优化后优势明显。

量子位
开源动态7

英伟力荐,小团队两个月开源一款「光速级」智能体推理引擎

智能体时代算力需求庞大,LightSeek Foundation 小团队 2 个月打造大模型推理引擎 TokenSpeed,有 TensorRT LLM 性能、vLLM 易用性,受英伟力荐且已开源,为智能体负载提供近「光速级」推理能力。

机器之心
新闻资讯8

突发,OpenAI首颗「辣椒」芯片压倒英伟!GPT-6干崩CUDA

OpenAI首颗自研芯片Jalapeño「墨西哥辣椒」实测成绩亮眼,AI推理性能超英伟全系,功耗仅为一半。它从设计到流片仅用九个月,得益于GPT - Astra协助。有观点认为CUDA护城河或已死,OpenAI正打造算力版图。

新智元
新闻资讯8

英伟下一代GPU登场,Rubin CPX一次推理数百万Token,网友:这是头野兽

在周二的AI基础设施峰会上,英伟宣布推出专为超100万token长上下文推理设计的Rubin CPX GPU。它将与其他产品组成新平台,性能卓越,还能复用现有平台,预计2026年底上市。

机器之心
新闻资讯7

向英伟发起挑战的 AI 芯片初创公司,估值快五百亿了!

人工智能芯片初创企业 Groq 完成 7.5 亿美元融资,投后估值 69 亿美元。它试图打破英伟垄断,产品是专用芯片,面向开发者与企业,成本低于竞品,创始人技术背景深厚,服务开发者数量增长快。

InfoQ