DeepSeek-V4-Flash」共找到 774 篇相关文章

推荐文章7

性能最高提升7倍?探究大语言模型推理之缓存优化

文章探讨大语言模型推理缓存优化技术演进与未来展望,介绍了主流推理框架vLLM、SGLang,分析KV Cache、Paged Attention、Prefix Caching等技术的优化点,还提及LMCache、DeepSeek的缓存技术,最后提到MCP赋能可视化OLAP智能体应用。

阿里云开发者
新闻资讯7

AI收入暴涨!英伟达超过苹果,成为全球市值第二

根据CompaniesMarketCap数据,英伟达公布财报后股价升超4%,一度成全球市值第一。截至5月29日收盘,其市值超苹果,仅比微软少150亿美元。虽此前受DeepSeek冲击,但Q1营收、利润仍创新高,二季度预计乐观。

AIGC开放社区
新闻资讯7

幻觉率降 27%、成本忽略不计:GPT-5.3 与 Gemini 新品对今年AI走向释放什么信号?

3月3日,OpenAI和Google几乎同时发布新模型,OpenAI推出GPT - 5.3 Instant,主打日常对话顺畅;Google发布Gemini 3.1 Flash - Lite,强调规模化智能。二者不追高端能力,分别从成本和体验着手,反映AI竞争重心转移。

深度学习自然语言处理
开源动态8

阶跃新模型快到“没推理”!印奇上任,果然气势一新

印奇上任后,阶跃星辰发布新一代开源Agent基座模型Step 3.5 Flash,总参数196B,支持256K上下文窗口。它推理快,适配多家芯片厂商,在多场景表现出色,还具备端云协同能力,架构也有多项优化。

量子位
新闻资讯8

我在WAIC看见的十大趋势

上海世界人工智能大会(WAIC)热度空前,一票难求。本文总结了WAIC呈现的十大核心趋势,如中国AI因DeepSeek而不同,开源大模型进入中国时间,AI创新来到ToC阶段,第一批商业化AI终端是汽车、耳机和眼镜等。

量子位
新闻资讯7

Claude还是最强,但Anthropic这周好像疯了

Anthropic状告阿里蒸馏模型致其股价创新低。一位87年创业者用AI搭工作流,起初用DeepSeek和Qwen问题多,换Claude后流程顺畅。MRCR v2测试显示国产模型与Claude有差距,便宜与省心模型该怎么选成问题。

探索AGI
产品应用8

谷歌认领最强AI版Photoshop!现在人人可用,效果确实强悍

谷歌认领神秘图像编辑模型nano - banana,即Gemini 2.5 Flash Image。它可免费在Gemini和Google AI Studio使用,API收费。该模型图像编辑能力出色,能合并图片、实现2D到3D转换等,此前爆火却无官方文档。

量子位
产品应用7

5万人抢光「阶跃龙虾」:3分钟一键部署,「养虾」终于变简单了

3月12日「阶跃龙虾」上线,提供5万个免费体验名额。此前阶跃星辰自研的Step 3.5 Flash模型在OpenRouter平台霸榜。其一键部署功能简化养虾流程,且云端版本支持7×24小时在线,国产厂商正推动AI Agent使用范式转变。

机器之心
新闻资讯7

2025 IMO真题撕碎AI数学神话,全球顶尖模型齐翻车!冠军铜牌都拿不到

2025 IMO数学竞赛中,全球顶尖AI模型均翻车。冠军Gemini 2.5 Pro仅得31分,连铜牌都拿不到。Grok - 4表现糟糕,DeepSeek - R1也令人失望。AI虽有思路,但逻辑细节不足,离成奥数大师尚远。

新智元
新闻资讯8

三个关键词,2026谷歌 I/O大会全说透了

北京时间今天凌晨,谷歌 I/O 2026 落幕。皮查伊称聚焦模型、编程和智能体。模型上,Gemini 3.5 Flash 全量上线,性能超上一代;编程方面,Antigravity 2.0 用低成本造能跑 Doom 的系统;智能体层,Spark 和 Search Agents 让 AI 走出对话框。

腾讯技术工程