「大算力芯片」共找到 5906 篇相关文章
多模态“卷王”阶跃星辰:如何利用 JuiceFS 打造高效经济的大模型存储平台
有“多模态卷王”之称的阶跃星辰,自研多模态模型,早期商业存储系统难满足需求,后引入 JuiceFS。文章介绍大模型各环节存储需求,详述 JuiceFS 企业版与社区版优化实践,含模型分发、读性能等优化。
HAMi 2.7.0 重磅发布 | 异构芯片全面拓展,调度更稳、生态更强
Dynamia密瓜智能宣布发布HAMi 2.7.0版,在硬件生态、调度器、应用层生态等方面有显著进展。硬件上支持昆仑芯、燧原、AWS等芯片;调度器优化了资源计算和可观测性;应用层与vLLM、Xinference等整合。
一夜之间,DeepSeek V4 Pro和Grok 4.6把全球大模型推入了新的斩杀线。
DeepSeek V4 Pro和Grok 4.6在两小时内发布,逼近Claude Fable 5体验。作者分享常用AI组合,分析两模型优缺点,指出它们撕开大模型不可能三角,形成新斩杀线,让夹在中间的模型难受。
Google 新论文离谱到家了,0延迟0成本通用,提升大模型准确率最简单的方法。
Google新论文提出简单提升大模型准确率的方法,即重复提示词,把完全一致的输入连续发2次。主流模型适用,经70项benchmark测试,0场景效果倒退,47个场景准确率提升,且几乎不增延迟、成本。
阿里云CIO首次系统复盘:大模型落地的RIDE方法论与RaaS实践突破
阿里云智能集团 CIO 蒋林泉分享大模型落地实践,介绍了阿里云在翻译、智能外呼等场景的应用案例,提出 RIDE 方法论,包括重组组织、识别机会、定义指标和推进执行,还分析了翻译和 Agent 模式的要点。
AI秒懂短视频,快手大模型Keye-VL理解力爆表!技术细节全开源
快手全新多模态大语言模型Kwai Keye-VL上线且开源,能深度融合多模态信息,在视频理解、复杂视觉感知和逻辑推理上表现优异。介绍了其技术架构、预训练和后训练策略及训练架构优化等内容。
VLA大模型做长任务总断片?同济KC-VLA用关键帧链给治好了
VLA大模型记性是短板,处理非马尔可夫任务常束手无策。同济大学等提出KC - VLA框架,用关键帧链接赋予机器人全局时间感知能力,还构建了长时序记忆依赖基准测试,实验显示其性能优越。
AI子弹已上膛!OpenAI斩获美国防部2亿美元大单,密谋向微软「开枪」
AI巨头权力洗牌加速,OpenAI与微软因收购Windsurf及股份问题关系紧张,甚至考虑反垄断指控。同时,OpenAI获美国防部2亿美元合同,有「OpenAI for Government」计划,还致力于建设算力设施。
对话西工大徐韬:昇腾生态如何为AI创新装上涡轮增压?|甲子光年
本文讲述西工大徐韬团队与昇腾平台深度合作的故事。他们从算子研究攻坚底层技术,开发抑郁症初筛等系统。昇腾还助力教学,让学生实践操作。未来,更多人将参与国产AI源头创新。
AI学会梦里干活!Claude发布3大进化,Dario:单人公司10亿美金爆发
在 Code with Claude 大会上,Anthropic 为 Claude Managed Agents 上线三项功能。‘做梦’解决记忆退化,成果评估自动检查工作,多 Agent 协作让复杂任务分工处理。Dario 称 AI 时代单人公司或达 10 亿美金营收。