「Grok V9」共找到 933 篇相关文章
如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性
文章通过分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在大规模 AI 训练中的表现。介绍三类训练负载及新的 Checkpointing 负载,分析共享文件系统类别,给出比较视角,解读各负载测试结果并总结选型要点。
“交互式Scaling”:增加Agent与环境交互的深度和频率来提升性能
在AI发展中,商业研究Agent是“黑箱”,开源研究Agent性能有差距。MiroMind团队推出MiroThinker v1.0,提出“交互扩展”提升性能,在多基准测试表现出色,也指出了当前版本的局限。
硅谷热议:最快语音转文字模型
AI语音独角兽ElevenLabs发布Scribe v2 Realtime实时语音转文本模型,实现150毫秒超低延迟、93.5%高准确率,覆盖90多种语言,打破速度与精度不可兼得困境,此前该领域痛点多。
DeepSeek最新模型意外泄露~
DeepSeek最新模型DeepSeek-V3-0526疑似泄露,消息源于https://docs.unsloth.ai/basics/deepseek-v3-0526-how-to-run-locally ,其性能媲美GPT - 4.5 / Claude Opus,或成最强开源模型,信息若属实将很快发布。
阿里开源 Vivid-VR!带来逼真连贯的视频修复
阿里开源 Vivid - VR 用于视频修复,基于 T2V 模型结合 ControlNet 保证画面一致性。它引入概念蒸馏训练策略,设计控制特征投影器和双分支 ControlNet 连接器,实验展现出优异表现。
马斯克翻车了!一边告OpenAI,一边偷偷蒸馏ChatGPT
4月30日,加州奥克兰联邦法院,马斯克诉OpenAI案进入第四天。马斯克承认自家Grok模型部分蒸馏了ChatGPT,还为AI公司排名,xAI垫底。法官拦下讨论AI灭绝话题,下周OpenAI联合创始人将出庭。
月薪3万,去内蒙草原给DeepSeek守机房
深度求索放出数据中心高级运维工程师等岗位,要将效率至上哲学从软件延伸到机房运营。其选择乌兰察布建数据中心,因当地条件优、产业生态成熟。且传闻其新一代大模型V4将发布,算力成决胜关键。
算力越高收入越多!OpenAI率先验证AI商业Scaling Law:最新收入200亿美元
OpenAI首席财务官公告显示,其年化经常性收入从20亿美元涨至200亿美元,2023 - 2025年算力增9.5倍、收入增10倍。挣得多也烧得多,其还投建数据中心。首款硬件或2026下半年推出。
Claude Opus 4.1被曝即将发布!Anthropic靠两大客户API收入超OpenAI
Claude Opus 4.1被曝正在内部测试,或重点提高推理和规划能力。Anthropic过去7个月ARR涨至50亿美元,API收入超OpenAI。但它收入依赖AI编程,面临GPT - 5、Grok等竞争。
如何为 GPU 提供充足存储:AI 训练中的存储性能与扩展性
文章分析 MLPerf Storage v2.0 测试结果,探讨不同存储系统在 AI 训练中表现。在满足 GPU 利用率阈值下,能支撑更多 GPU 的存储系统扩展性与稳定性更强,还需关注资源利用率。以太网存储方案灵活且成本效益高。