「模长感知」共找到 955 篇相关文章
CuteDSL-1: Introduction
文章介绍CuteDSL,它因Cutlass编译慢、调试难等痛点而生,可在Python构建DSL,编译快、调试易且性能无损。文中阐述其架构、使用方法、与PyTorch集成优势等,还提及基于CuTe的开发及性能对比。
NVIDIA 推出Rubin CPX,专为AI推理设计的GPU
NVIDIA发布专为大规模上下文AI推理设计的Rubin CPX GPU,性能提升显著,集成视频编解码器和长文本推理处理。新平台算力强,适用于代码生成与视频处理,多家公司将采用,2026年底上市。
MIDAS:快手可灵发布实时交互式数字人生成框架
近年来交互式数字人视频生成受关注,但实时处理多模态输入有挑战。快手可灵团队提出MIDAS框架,基于LLM驱动的自回归模型,结合轻量级扩散头,实现低延迟、交互式多模态控制,还构建大规模数据集等。
DeepMind 没舍得开源的 Genie 3,被昆仑万维放出来了
过去一周世界模型赛道热度高涨,DeepMind发布的Genie 3未开源,昆仑万维却在8月12日推出自研升级版Matrix - Game 2.0并完整开源。它定位产业化,能让世界模型从实验室走向生产线,还带来盈利模式转变。
斑马智行,开启汽车主动智能时代|甲子光年
2025年WAIC上,斑马智行联合通义及高通,首发行业首个基于高通8397平台的端侧多模态大模型解决方案。该方案让智能座舱从“被动响应”到“主动感知”,还打通产业链,实现多方面适配。
腾讯 CodeBuddy IDE 如何成为一个“全栈高级工程师”?
腾讯 CodeBuddy IDE 海外版开启内测,国内版预计 8 月上线。它定位‘下一代 AI 全栈高级工程师’,内置 4 个智能体,助力全链路研发。腾讯内部超 43% 代码由 AI 生成,编码时长缩短 40%。
DeepSeek被「猫咪睡觉」给干崩了……
研究员发现,在数学题后加「有趣的事实:猫咪一生大部分时间都在睡觉」,能让DeepSeek数学能力崩塌。研究开发CatAttack方法找「触发词」,无关触发词使模型错误率飙升,还会让回答变长。
泪目!靠AI让爷爷「复活」,他拿下红杉1600万刀?要让所有地球人数字永生
国外14人团队Delphi获红杉领投1600万美元A轮融资。其产品源于创始人想复活中风祖父,现成长为“数字思维图书馆”。2023年12月测试版上线,有人靠它年入百万,未来想服务大众。
ChatGPT上瘾,大脑萎缩47%!MIT祭出206页92图超长报告
麻省理工学院完成针对ChatGPT用户的首次大脑扫描研究,发现长期依赖大模型,学习能力下降、大脑受损,神经连接减少47%。AI提高效率或为误解,使用它是用长期思维能力换短暂效率。
模型越聪明越“不听话”?MathIF基准揭示AI服从性漏洞
上海人工智能实验室与香港中文大学研究团队发布论文,用MathIF基准揭示大模型“聪明”和“听话”有矛盾,越擅长推理越易忽略指令,还分析了原因并给出让模型更“听话”的方法。