「推理计算」共找到 2584 篇相关文章
留给人类数学家的悬赏不多了!谷歌DeepMind一口气解决9道埃尔德什问题
AI进军数学界速度惊人,谷歌DeepMind发布由Gemini驱动的AlphaProof Nexus框架,解决9个埃尔德什开放问题,还证明44个猜想、搞定代数几何难题、改进凸优化理论边界,推理成本低且代码开源。
一个月的活一周干完!英伟达世界模型训练速度飙升400%
英伟达世界动作模型 DreamZero 训练成本高、耗时长,无问芯穹与清华等推出的 RLinf 框架,从算子融合到 I/O 全链路系统级重构,使训练吞吐拉高近 4 倍,还解决多类性能瓶颈,保证训练效果。
机器狗翻了个身,国产GPU往前走了坚实一步|甲子光年
5月18日摩尔线程发布会上,机器狗“小飞”侧空翻,是业内首次基于国产硬件仿真平台训练、国产端侧芯片部署并真机验证。该司以全功能GPU打造国产具身智能基础设施,MT Lambda平台解决多方面问题。
阿里巴巴 & 蚂蚁 LoongSuite GenAI 可观测语义规范:从统一数据语言到规模化落地
随着GenAI发展,OpenTelemetry推动语义规范建设。阿里巴巴与蚂蚁联合推出LoongSuite GenAI SemConv,在OTel基础上增强,新增Entry/Step Span、Skill语义、Token级推理观测,还推出GenAI Utils简化插桩开发。
去掉 VAE 之后,商汤用 8B 参数重新定义了开源生图的上限
商汤SenseNova U1开源后引发开发者社区关注,它基于NEO - unify架构,摒弃VAE,实现多模态理解与生成原生统一。在多项基准测试中表现出色,还针对企业办公场景优化,成为生产级任务新选择。
CNCF 警告:仅靠 Kubernetes 不足以保障 LLM 工作负载的安全性
云原生计算基金会(CNCF)指出,企业在 Kubernetes 上部署大语言模型(LLM)存在安全缺口。Kubernetes 无法理解或控制 AI 系统行为,需增加额外控制层,引入 AI 特定控制。
公里级场景也能稳住了,国产团队把长视频3D重建又往前推了一步
浙江大学、地平线机器人和之江实验室的新工作 Scal3R 要解决长视频 3D 重建问题。它借助 test - time training 技术,设计全局上下文模块和同步机制,提升长序列重建稳定性和精度,能处理超万帧几千米的场景。
刚刚,DeepSeek多模态技术范式公布,以视觉原语思考
DeepSeek发布多模态模型并公布技术报告,提出‘以视觉原语思考’。该模型解决多模态大模型‘指代鸿沟’问题,有把坐标变思维单元、7056倍视觉压缩、精心设计冷启动数据等创新,实验在多任务上超主流模型。
京东广告大模型实战:GRAM 架构如何在 50ms 内完成生成式推荐?
流量红利见顶,广告营销转型遇挑战。京东张泽华在大会公开应对方案,介绍 GRAM 架构,实现意图与商品语义对齐,控制推理时延,解决冷启动等问题,还分享算法与知识工程实践。
RF-DETR-首个突破60 AP的实时检测器(附实战教程)
RF-DETR在COCO数据集上,实时检测精度首破60 mAP,兼顾实时性与高精度。它通过NAS找到Transformer实时运行的‘最优解’,迭代快,适用于多场景,还给出完整实战教程。