Kimi K2 Thinking模型」共找到 7868 篇相关文章

新闻资讯7

GPT-5终于来了!在惊喜不多的时代,它是否值得我们的等待?|甲子光年

北京时间8月8日凌晨1点,OpenAI正式发布新模型GPT-5。它是目前最强通用模型,在多方面全面进化,将成ChatGPT默认模型。不过它虽有进步,但未掀起革命,GPT系列或难有飞跃,而OpenAI仍规划了未来发展。

甲子光年
新闻资讯8

地球级AI智能体爆诞!谷歌地球开外挂,一夜为20亿人洪水预警

谷歌结合世界建模经验与Gemini推理能力,升级Earth AI。它是地理空间AI模型和数据集,可自动连接不同地球AI模型。谷歌还推出新成果,如新一代影像与人口基础模型、空间推理智能体,可用于灾害预警等。

新智元
算法论文7

1/3预算跑平 GPT-5?上海AI Lab「路由魔法」成本直降63%性能反涨 7%!

当前大模型需解决性能与效率平衡问题,GPT - 5用测试时路由技术初步平衡。Avengers - Pro测试时路由框架集成不同LLMs,通过嵌入、聚类、评分操作,调整权衡参数α,能依查询特征选模型,性能和效率优于单一模型

CourseAI
开源动态8

面向 SGLang 的 Profile Analysis SKILL:3 张表定位 Kernel Fuse 和 Overlap 机会

文章介绍了面向SGLang的Profile Analysis SKILL,其工作流统一,输出3张表定位Kernel Fuse和Overlap机会,支持多种分析方式和模型。还给出Qwen/Qwen3.5 - 4B和openai/gpt - oss - 20b的分析结果,并表明该SKILL能节省token、缩短工期,作者厌恶Torch Compile。

GiantPandaLLM
算法论文8

Anthropic让AI先读员工手册再上岗:失控率从54%降到7%

Anthropic最新研究「模型规范中期训练」(MSM)显示,相同训练数据配不同行事原则,模型表现不同。MSM在预训练和对齐微调间加中间阶段,让模型读规范文档理解准则,在特定实验中,将Agent失控率从54%降到7%。

新智元
开源动态8

开启端侧长文本时代!面壁全新架构,让小钢炮最快提升220倍

2025智源大会上,面壁智能发布MiniCPM 4.0模型,实现行业首个系统级上下文稀疏语言模型创新。它在端侧推理任务上表现出色,降低缓存需求,提高运行效能,还进行多维度架构创新,是AI领域探索高效率语言模型的里程碑。

机器之心
算法论文7

3D-R1重塑三维视觉语言推理!让三维交互更智能

近年来,视觉 - 语言模型在2D图像理解有突破,但3D视觉语言模型面对复杂场景不足。为此上海大学团队提出3D - R1模型,它基于新数据集和策略构建,有强多任务三维理解能力,不过也存在进步空间。

带你学AI
产品应用9

深度解读 DeepSeek V4.1 Flash 全新架构,如何成为显存杀手

本文深度解读DeepSeek最新发布的V4.1 Flash大模型,详解其全新CED架构与第二代压缩稀疏注意力CSA2,揭秘其通过架构创新大幅压缩KV缓存、降低显存算力成本,在长上下文Agent场景实现性能反超的细节。

AI科技评论
新闻资讯7

暴走东京电玩展,Game Show也AI上了

东京电玩展上,网易、腾讯等中国游戏厂商摆大展台,AI厂商也秀出肌肉。阿里展出通义千问和通义万相,拿出大模型商用化方案;3D生成受关注,混元3D、VAST Tripo等受游戏厂商青睐;AI陪玩HakkoAI海外首秀成绩亮眼。

量子位
新闻资讯9

换题还是第一!DM0.5横扫RoboColiseum四榜

本文报道原力灵机DM0.5在智元机器人发起的RoboColiseum具身模型评测中拿下四个单项第一,这已是该模型连续拿下六套不同类型公开评测的榜首,攻破了传统具身模型换题掉分的痛点,目前已开源落地产业场景。

机器之心