「通用GPU」共找到 1119 篇相关文章
AI视频进入蒸汽机时代
百度蒸汽机 2.0 迎来重磅升级,推出行业首个通用 AI 长视频生成功能,突破时长限制,引入交互式需求表达功能。它解决了传统视频生成痛点,在多个维度优化创新,还带来商业应用新可能。
CVPR 2026|用互联网视频替代3D标注:通研院团队打造SceneVerse++「最大规模」真实3D场景数据
北京通用人工智能研究院团队在CVPR 2026接收论文中,提出自动化数据引擎,用互联网视频构建SceneVerse++数据集,规模超现有同类,在3D检测、VQA、VLN任务提升性能,还指明3D空间智能发展方向。
OCR又出宠OpenDoc,速度超MinerU6倍
复旦开源的OpenOCR是面向通用OCR任务的开源平台,其OpenDoc是超轻量文档解析系统。它采用Pipeline模式,两阶段解析不易放大误差。UniRec - 0.1B有独特架构与分层监督训练等创新技术。
142 TFLOPS 的差距:为什么在 Blackwell 上 FP4 MoE 算子工程至关重要
文章对三种主流MoE后端在Blackwell B200 GPU上做基准测试,发现SGLang与vLLM有142 TFLOPS差距,小batch时SGLang快1.84×。差异源于kernel融合、面向Blackwell的CUTLASS schedule及自适应grid sizing等优化。
小米开源首个跨域具身基座模型MiMo-Embodied,29个榜单SOTA
小米具身智能团队开源跨域基座模型MiMo - Embodied,它融合自动驾驶与具身智能,在29个榜单创SOTA。该模型基于MiMo - VL架构,采用四阶段训练策略,有效解决领域割裂问题,为通用VLA模型奠定基础。
390亿美元,全球具身智能第一估值来了!英伟达持续加注中
与OpenAI分道扬镳后,Figure C轮融资获超10亿美元承诺资本,投后估值达390亿美元。资金将用于扩大人形机器人大批量制造与部署、搭建GPU基础设施、启动数据采集项目,助力具身智能发展。
内幕曝光:OpenAI模型坦承不会第六题,3人俩月拿下IMO金牌!
OpenAI三人团队俩月让AI达IMO金牌水平。他们用多智能体系统技术,使模型能短时间解复杂问题。新模型有自省能力,减少“幻觉”问题。此次突破是通用推理技术进步,未来将整合进更多模型。
大模型竞赛转向:决胜关键为何是“后训练”?|甲子光年
大模型价值主战场向后训练转移,Grok 4凭后训练成“宇宙最强”。产业应用中通用模型适配难,后训练方法也在进化,如采用SFT+RL等,还介绍了夸克和阿里云的后训练实践。
GPT-5难产内幕曝光!核心团队遭挖空,推理魔咒难破,靠英伟达续命
外媒The Information曝出GPT-5诞生内幕,其未取得技术突破,OpenAI面临数据瓶颈与技术难题,核心研究者被撬导致组织架构混乱。不过,OpenAI获巨额融资,推理模型成突破口,还在开发“通用验证器”。
3亿美元薪酬被10人拒绝!OpenAI首席研究官一句话引发硅谷史上最疯狂抢人大战
据华尔街日报爆料,Meta小扎开出3亿美元“挖人费”,至少10位OpenAI员工拒绝。OpenAI首席研究官Mark Chen一句话引发抢人大战。Meta超级团队44人中,40%来自OpenAI,50%是华人。小扎承诺算力管够,逼得OpenAI将上线100万个GPU。