Kimi K2.5模型」共找到 8996 篇相关文章

新闻资讯8

全球顶尖大模型一夜惨遭血洗!最难测试人类拿满分,AI第一名得0.2%分

全球最难AGI测试ARC - AGI - 3上线,人类满分通关,最强模型Opus 4.6仅得0.2%。测试从静态题变为互动游戏,评分看效率。前沿大模型得分低,非LLM方案表现更好,AI缺乏元认知能力。

新智元
算法论文8

不换模型,效果提升104%!上海AI Lab让Harness也能自进化了

上海人工智能实验室团队提出的Self-Harness引发关注,它针对Agent外层Harness改进。实验显示,在Terminal-Bench-2.0上,不换模型只改Harness,Qwen3.5-35B-A3B等模型效果显著提升。

量子位
推荐文章8

小白也能看懂,一文彻底说清 MCP、A2A与AG-UI,大模型应用集成协议三件套。

文章面向有一定技术基础但不熟悉大模型应用开发的读者,通俗介绍MCP、A2A和AG - UI三大主流集成协议,分别解决不同的集成难题,三者构成大模型应用集成完整生态。

AI大模型应用实践
产品应用8

Claude Opus 4.6推出极速模式:速度提升2.5倍,价格狂飙6倍

Anthropic官方宣布Claude Opus 4.6极速模式上线,速度比标准版快2.5倍,已向Claude Code和API用户开放。它非新模型,是重配置,价格更高,官方有优惠,还介绍使用方法、场景及限制。

AI寒武纪
开源动态8

开源大模型SOTA又刷新!中国MiniMax M2全球排名第五,开源榜一

中国AI独角兽MiniMax发布模型M2,刷新开源SOTA。它采用混合专家架构,平衡了智能、速度和成本。在多个权威测试中表现优异,价格仅为Claude 3.5 Sonnet的8%,还提供多种部署方式和限时免费服务。

AIGC开放社区
开源动态8

纯血国产!4B模型越级打怪,杀入万亿赛道

9月1日,Hugging Face上线星火X2.5-4B和1.7B开源端侧模型,在多指标测试中表现优异,实现“越级打怪”。该模型基于全国产算力平台训练,在断网笔记本上实测效果惊艳,使用了两项技术提升能力,适配性强。

新智元
产品应用7

Claude Code 实战横评:GLM4.5 vs DeepSeek 3.1(附Windows MCP配置,免费模型接入)

文章对Claude Code里GLM4.5和DeepSeek 3.1进行实战横评,涵盖数据库、网站、游戏等测试案例。还介绍Claude Code在Windows下配置MCP经验,以及接入GLM、Deepseek等模型的方法和免费平台。

AI进修生
产品应用8

Deepseek V4 Pro深夜上线,性能追平Fable 5,但价格只有它的2%

2026年8月12日,DeepSeek V4 Pro正式版上线。它是混合专家模型,规模居世界第一梯队。价格比Claude Fable 5便宜超98%,成本优势明显。其架构节省成本,API开放多模式,产品结构清晰。

DeepTech深科技
开源动态8

B站出海的强有力支柱:最新开源文本转语音模型IndexTTS-2.0标志零样本TTS进入双维度时代

B站Index团队开源文本转语音模型IndexTTS - 2.0,引发关注。它解决了传统AR模型时长控制难题,实现零样本TTS双维度控制,在多方面表现优异,为B站出海及AIGC应用奠定基础。

机器之心
新闻资讯8

小米罗福莉:MiMo-V2.5如何做到又快又强又便宜? | ICML 2026

2026年7月ICML大会上,小米MiMo团队负责人罗福莉介绍MiMo - V2.5系列。该系列跳出传统思路,从架构、训练、推理协同设计,实现“聪明、快速、便宜”,如预训练降成本、后训练有硬核算法、推理加速达1000 TPS。

AI科技评论