「硬件算力」共找到 1194 篇相关文章
全球闲置算力训个模型,性能媲美R1,老黄天塌了!Karpathy曾投资它
全球首个分布式RL训练模型INTELLECT - 2发布,整合闲置算力完成训练,成本降低,性能媲美DeepSeek - R1。其采用分布式异步强化学习范式,团队开源四大关键组件,还获Karpathy等投资,未来有多项计划。
现实世界的天气能复刻?Weather-Magician实时渲染下雨打雷下雪
传统工业方法在还原复杂现实场景时成本高、质量差,当前算法也难重建和渲染真实天气效果。上海交通大学提出Weather - Magician框架,能重建场景并渲染4D天气效果,对硬件要求低且可实时渲染。
刚刚,苹果绝密计划曝光!3年7款新品,AI眼镜27年卖爆千万台
知名分析师郭明錤爆料,苹果正秘密研发7款头显,2025年M5版Vision Pro打头阵,2027年智能眼镜将席卷市场,1000万台出货量可期。苹果硬件实力强,但AI软件是瓶颈。
微软发布GUI Agent新范式!告别传统方式,小参数少数据,7B吊打72B模型
微软发布GUI Agent新范式GUI - Actor,告别传统Agent定位死板、缺乏空间感和兼容性差等问题。它用无坐标交互技术,在测试中表现优异,省数据算力,未来在多领域有应用潜力。
单卡跑出集群效率!Hugging Face TRL 与 RapidFire AI 的超并行革命
Hugging Face宣布其核心微调库TRL集成RapidFire AI,重构大模型后训练阶段工作流。RapidFire引入超并行实验引擎,提升实验验证速度,解决算力受限团队的调参难题,带来效能质变。
DeepSeek突然拥抱国产GPU语言!TileLang对标CUDA替代Triton,华为昇腾Day0官宣支持适配
DeepSeek v3.2开源TileLang版本算子引关注,其可对标CUDA替代Triton,还适配国产算力生态,华为昇腾官宣支持。TileLang由北大团队主导,提供不同层次编程接口,助DeepSeek提升性能。
VeRL-Omni:面向扩散和全模态生成模型的通用RL后训练框架
VeRL-Omni是面向多模态生成模型的通用RL后训练框架,覆盖多种架构。它有高效多模态rollout、灵活奖励引擎等特性,支持多种硬件,团队还验证了不同训练方式,后续将扩展模型与算法支持。
华为升级行业Agent算法架构!MindScale自己写prompt和工作流,KV Cache减少5.7倍token
华为诺亚方舟实验室更新面向行业应用的算法包MindScale,融合算法创新与业务实践经验。它梳理了Agent时代技术挑战,给出技术论文与昇腾代码,应对工作流维护等难题,还提升训推效率、适配国产硬件。
硅谷最狠「伪君子」!华人女记者深扒OpenAI:3000亿AI帝国全靠偷数据?
华人女记者郝珂灵深挖OpenAI黑历史,其新书《Empire of AI》引发巨大反响。书中指出OpenAI宣称造福人类,实际是资本机器,其技术发展路径依赖数据和算力,还存在AI让少数人受益、AGI定义模糊等问题。
刚刚,苹果官宣iphone搭载最强AI,每年给Google 10亿,不愿在信ChatGPT。
早上苹果与Google官宣的新闻刷屏,下一代苹果基础模型将基于Gemini构建。苹果因自研来不及且人才流失,选择花10亿买Google模型。还分析了未选OpenAI的原因,以及隐私方面的问题。