kimi k3」共找到 2527 篇相关文章

推荐文章8

AI 基础知识从 0.5 到 0.6—— Transformer 架构为何能统治AI领域?

文章围绕Transformer架构展开,先介绍其诞生背景,对比CNN、RNN等模型,阐述其在多领域的核心地位。接着剖析工作流程、实现原理,包括QKV机制、多头注意力等。最后列举T5、GPT等常见架构模型,并提及通义千问3与MCP协议。

阿里云开发者
新闻资讯8

芯片团队规模近3000人!小米扩张自研芯片版图

8月24日小米举行玄戒芯片技术沟通会,公布三颗自研芯片:AI旗舰SoC玄戒O3、端侧AI加速芯片玄戒O100、智驾高算力AI芯片玄戒D100。小米重启大芯片研发五年多,投入超210亿,芯片团队近3000人。

芯师爷
新闻资讯7

为什么林俊旸会离职? | 甲子光年

3月4日凌晨,阿里Qwen团队技术负责人林俊旸宣布离职,同一天Qwen后训练负责人郁博文也正式离职。阿里刚开源Qwen 3.5小尺寸模型获马斯克点赞,此时核心团队出走引发关注。林俊旸离职或因团队分拆、管理范围缩小及“开源”与“闭源”的矛盾。

甲子光年
产品应用7

前钉钉最年轻副总裁的AI冒险:当AI开始“雇佣”人类|甲子光年

前钉钉最年轻副总裁王铭带领攀峰智能K2 Lab获数千万元种子轮融资。其首款产品拟人化商业专家Moras是全球首个面向超级个体的商业化Agent,解决海外达人变现痛点,采用‘底薪+提成’模式,还探索‘AI雇佣人’新商业模式,目标成AI时代的Shopify。

甲子光年
新闻资讯7

36个月大逆转!他带着谷歌AI杀回来了,下一步世界模型

ChatGPT发布近36个月,哈萨比斯带领谷歌AI反攻,新发布的Gemini 3在多模型榜单登顶,表现优于GPT - 5。谷歌将其作为底层模型开放,增强现有产品,还考虑重启谷歌眼镜项目。谷歌正缩小与OpenAI差距,哈萨比斯预计5 - 10年实现AGI。

新智元
7

新国产GPU「曦望」,刚融了10个亿

国产GPU公司曦望Sunrise由商汤2024年底分拆独立,时隔半年完成近10亿融资。其产品曦望S1、S2已量产,S3在研发。两位联席CEO分别是百度元老王湛和AMD芯片老将王勇,核心团队规模小但成果显著。

量子位
开源动态7

智谱新模型也用DeepSeek的MLA,苹果M5就能跑

智谱AI上市后发布新成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。

量子位
新闻资讯7

Anthropic最新博客:MCP没有死,我们又救活了。

2个月前Eric Holmes认为MCP已死,因其有Token成本等问题且LLM本就会用命令行。但本周Anthropic发博客称想清MCP定位,它不是替代CLI,而是覆盖其到不了的地方,还给出改进方案,MCP月下载超3亿次。

探索AGI
新闻资讯8

慕了!内存芯片巨头年终奖人均64万;32岁程序员猝死背后公司被扒,曾给39万“封口费”;马斯克曝星舰成本将降99%,商业航天受捧|AI周报

这是一篇AI周报,涵盖多领域热点。如SK海力士发高额年终奖;月之暗面张予彤称Kimi用少量资源开发领先模型;马斯克透露星舰目标、人形机器人计划等;多家公司有新动态,如阿里推AIGC应用、百川发布医疗大模型等。

AI前线
算法论文8

FlashAttention 完全进化史:FA-4 发布之际的技术全景回顾

文章围绕FlashAttention展开,从Attention性能瓶颈引出问题,阐述其各版本演进。FA-1实现算法突破,避免O(N²)内存;FA-2适配架构,提升性能;FA-3深度协同,实现异步;FA-4探索更深异步和角色分工。还探讨跨芯片迁移及未来优化方向。

GiantPandaLLM