Kimi大模型」共找到 9143 篇相关文章

产品应用8

英伟达帮你省钱,让模型推理「短而精」,速度快5倍

过去模型推理追求长链思维,导致推理链长、Token消耗、响应慢。英伟达研究院的DLER研究给出解决办法,通过强化学习优化方法让模型‘短而精’,推理长度减超70%且准确率不变,还适用于模型

机器之心
推荐文章8

硬核拆解模型,从 DeepSeek-V3 到 Kimi K2 ,一文看懂 LLM 主流架构

本文详细列举 8 个主流语言模型,硬核拆解架构设计与革新思路,介绍架构演进趋势。如 DeepSeek-V3 的 MLA 与 MoE 技术,OLMo 2 的归一化策略,Gemma 3 的滑动窗口注意力机制等。

机器之心
开源动态8

模型即智能体,Kimi K2 Thinking多项评估超越顶尖闭源模型,300轮工具调用不疲倦

月之暗面发布Kimi K2 Thinking,它是Kimi迄今最强开源思考模型,基于模型即智能体理念训练,可自主连续工具调用与多轮思考,多项评估超顶尖闭源模型,还实现原生INT4量化,提升生成速度。

AIGC开放社区
开源动态8

国产类脑模型适配国产沐曦GPU!长序列推理提速超百倍,仅用2%数据匹敌主流模型

中国科学院自动化所李国齐、徐波团队发布类脑脉冲模型SpikingBrain (瞬悉)-1.0,借鉴脑信息处理机制,适配国产沐曦GPU,长序列推理提速超百倍,仅用2%数据匹敌主流模型,探索构建国产自主可控类脑模型生态。

量子位
推荐文章7

数据到好猜想:如何用模型做市场研究?

文章指出模型重塑用户需求调研,并非按常规用AI获取和清洗数据,而是让模型扮演真实用户。以品牌分析社交媒体数据为例,探讨数据局限,还介绍‘好猜想’标准,最后说明Atypica.AI能构建消费者智能体解决归纳问题。

Founder Park
推荐文章8

别再迷信模型!吴恩达亲授AI秘籍:小模型+边缘计算=财富密码

吴恩达指出,AI创业真机遇不在模型,而在智能体。智能体市场潜力,创业者可发挥其专业化优势。还建议忽略AGI,用AI解决日常问题,关注小模型边缘计算、军民两用场景,构建可信AI应用。

新智元
推荐文章7

模型是不是到顶了?瓶颈到底在哪

文章探讨模型是否到顶,指出‘到顶’争论分三个问题,靠堆模型提升能力之路变平,受数据和成本约束。但模型还有后训练和推理时计算两个发展方向,未来进步或来自更会用算力。

AI Reading Hub
产品应用7

卡帕西模型横评方法太好玩了!四AI匿名参赛评分,最强出乎意料

卡帕西发布“模型议会”web app,系统通过OpenRouter调起多模型开会商议,各模型答题、互评、排序,由主席模型给出统一答案。可对比模型差异,模型自评与人类主观或不同,多模型集成或成突破点。

量子位
开源动态7

突发!Qwen更新模型,全面超越kimi k2,强的离谱,主打Agent

Qwen小更新非推理模型性能强劲,各项指标超kimi k2,与Claude opus 4持平,Agent能力亮眼。Qwen团队告别混合思维模式,新模型上线,独立训练两模型,新版本多方面提升,团队称还有招。

AI寒武纪
新闻资讯7

《AI模型与异构算力融合技术白皮书》10月10日发布

算泥社区《AI模型与异构算力融合技术白皮书》10月10日14:00线上发布。AI模型爆发使算力需求激增,异构算力成刚需。国内外政策与产业驱动其发展,该白皮书能为开发者提供实用技术参考。

AIGC开放社区