Kimi K3」共找到 2493 篇相关文章

新闻资讯8

叛变!OpenAI亲儿子竟然选了Kimi K3

OpenAI投资的法律AI公司Harvey,首个自研模型Harvey Tenet选中国开源模型Kimi K3作底座。因原用闭源模型成本高、有竞争风险。Tenet训练成本低、性能佳,显示出可复制路径。

新智元
产品应用7

Kimi K3设计榜登顶焚诀公开:就藏在思维链里

Kimi K3在Design Arena单次生成前端榜单中夺冠。它做前端设计审美一流,靠独特思维链反复迭代优化方案,还具备强大数据索引能力。不过上线48小时因算力不足叫停新订阅。

量子位
开源动态7

闭源RSI的严父来了:18个Agent自主科研,Kimi K3靠Harness逼近Opus 5

开源AI基础设施公司Prime Intellect研究表明,借助多智能体Harness,让开源模型负责监控和实现,可让‘AI开发AI’更便宜、效果更好。实验中,Kimi K3搭配Harness逼近Opus 5。

量子位
推荐文章7

8种LLM架构设计大比拼:从 DeepSeek-V3Kimi K2,究竟有啥不同

文章对比了8种LLM架构设计,如DeepSeek-V3、OLMo 2等。介绍各模型关键技术,像DeepSeek-V3的多头潜在注意力和混合专家架构,还分析不同设计对性能、效率的影响,助读者了解LLM架构差异。

CourseAI
产品应用8

藏师傅 Kimi K2 Thinking 首测!教你用 Kimi 编程全家桶

本文首发测评藏师傅 Kimi K2 Thinking,介绍 Kimi 编程全家桶。K2 Thinking 有 Agent 化等多方面升级,还推出 Kimi CLI 工具与 KFC 套餐。作者展示全家桶使用方法并多维度测试,肯定其表现,赞 Kimi 战略清醒务实有远见。

歸藏的AI工具箱
推荐文章8

从DeepSeek-V3Kimi K2:八种现代 LLM 架构大比较

文章对比了DeepSeek-V3Kimi K2等八种现代LLM架构。介绍各模型独特技术,如DeepSeek V3的多头潜在注意力和混合专家技术,OLMo 2的后归一化策略,Gemma 3的滑动窗口注意力等,探讨架构改进与突破。

PaperAgent
推荐文章8

硬核拆解大模型,从 DeepSeek-V3Kimi K2 ,一文看懂 LLM 主流架构

本文详细列举 8 个主流大语言模型,硬核拆解架构设计与革新思路,介绍架构演进趋势。如 DeepSeek-V3 的 MLA 与 MoE 技术,OLMo 2 的归一化策略,Gemma 3 的滑动窗口注意力机制等。

机器之心
开源动态8

kimi K3超大杯升级背后的技术内幕

文章介绍开源模型 K3 架构设计思路。主要探讨 MoE 和 MLA 部分,在 MoE 方面提出 SiTU、Norm、QB 改进;在注意力机制选择 MLA,与 KDA 混合缓解部分问题,还谈及 DSV4、NoPE 相关特点。

Agent的潜意识
开源动态8

Kimi K2官方技术报告出炉:采用384个专家,训练不靠刷题靠“用自己的话再讲一遍”

Kimi K2官方技术报告公开称霸全球开源模型的秘籍,介绍其训练过程及“秘密配方”,包括MuonClip优化器、大规模Agentic Tool Use数据合成等技术亮点,还提及后阿里通义Qwen3更新击败Kimi K2。

量子位
产品应用7

全网爆火的Kimi-k2驱动Claude Code亲测可食用版本来了「附详细配置」

Claude Code好用但贵,Kimi-k2表现不错且API价格便宜。月之暗面团队为Kimi K2提供与Anthropic兼容的API端点,文章给出在Claude Code使用Kimi K2的亲测配置方法。

AI寒武纪