「V3 Spec」共找到 2376 篇相关文章
Ollama升级模型调度系统:内存管理更精准,多GPU性能提升
Ollama升级模型调度系统,精确测量运行模型所需内存,带来内存崩溃减少、GPU利用率提高等改进。Gemma3、Mistral - small3.2等模型性能提升,更多模型正迁移,还在开发iGPU支持,评估NPU支持。
确认!DeepSeek多模态AI已经开测
DeepSeek研究员陈小康、陈德里确认其V4视觉模式开始灰度测试。更新后出现识图模式,具备真实图像理解能力。陈小康是多模态研究组负责人,陈德里负责语言模型等核心方向,V4可谓满血归来。
年底,国产开源LLM又迎来一波大爆发:Qwen、美团、智谱、腾讯、百川
年底国产开源LLM大爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等多个模型,各有亮点,如Qwen3 - TTS覆盖多语种,LongCat支持重思考模式。
Suno、Udio都被它干翻!中国AI音乐模型拿下AA全球榜单双料冠军
昆仑万维旗下 AI 音乐大模型 Mureka V8,在 Artificial Analysis 榜单上登顶 vocals 和 instrumental 双榜第一,超越国际主流模型。实测亮点多,其技术进步显著,V9 也将解决表达偏差问题。
Kubernetes v1.36 发布:安全默认配置强化,AI 工作负载支持日趋成熟
Kubernetes发布1.36版本,代号Haru,含70项增强功能。聚焦安全加固、AI和机器学习负载及API扩展性。安全功能多达GA,AI负载适配需求,还引入新功能,同时移除部分旧功能,Ingress NGINX正式退役。
DeepSeek V4永久降价!缓存命中再打1折,实测编程成本骤降83%
DeepSeek两天连续两次降价,输入输出2.5折,命中缓存输入折上再1折且无时限。实测编程成本骤降83%,此前31.73元,打折后只需5.34元。其曾引发价格战,此次对海外用户冲击更大。
程序员从此不再写代码!红杉专访Codex团队,o3白菜价真相曝光
红杉专访OpenAI Codex团队,揭示AI编程未来。Codex从代码补全演化为智能体,强调委托心态,开发者从动手转向审核。还爆料OpenAI内部有递归自我改进的AI Alice。
开源版Genie 3世界模型来了:实时+长时间交互,单卡可跑,国内公司出品
本月初 Google DeepMind 发布 Genie 3 引发关注,没过两周昆仑万维就推出开源交互世界模型 Matrix - Game 2.0,参数量 1.8B,单卡可跑,能实现实时长序列、交互式生成,经测试潜力大。
不换模型,效果提升104%!上海AI Lab让Harness也能自进化了
上海人工智能实验室团队提出的Self-Harness引发关注,它针对Agent外层Harness改进。实验显示,在Terminal-Bench-2.0上,不换模型只改Harness,Qwen3.5-35B-A3B等模型效果显著提升。
华为创造AI算力新纪录:万卡集群训练98%可用度,秒级恢复、分钟诊断
大模型落地需强大算力集群支撑,构建万卡级算力集群是顶尖挑战。华为昇腾万卡算力集群近乎‘永不罢工’,其公开技术秘密,提出‘3+3’双维度技术体系,多项指标表现优异。