DeepSeek 1.5B」共找到 4015 篇相关文章

推荐文章8

AI-Native 的 Infra 演化路线:L0 到 L5

文章来自 Agent Infra 创业者 Hang Huang,以其产品开发实践经验,分享 Agent Infra 机会。指出 AI 编程生产力跃迁,从写代码到掌控软件全生命周期是趋势,还提出 L0 - L5 模型描述 AI-Native Infra 演化路径。

海外独角兽
新闻资讯7

GPT-5的魔幻现实主义:当技术神话撞上用户预期

奥特曼宣传数月的GPT - 5上线24小时遭用户吐槽,实测基础数学、拼写有问题。其采用智能路由系统,调教欠佳。奥特曼承认自动切换器故障,基准测试结果混乱,还暴露AI评价难等问题。

AI工程化
新闻资讯8

刚刚!Sam Altman官宣GPT-5今夏登场:超级智能更为重要

在OpenAI官方播客节目中,Sam Altman透露GPT-5今夏或登场,还探讨AGI定义、“星际之门”算力项目、AI硬件等。如模型命名或改,算力项目解决瓶颈,重视超级智能等。

AI寒武纪
新闻资讯7

谷歌邪修Gemini 3.8 Flash!险胜DeepSeek,姚顺宇:RSI一大步

谷歌发布Gemini 3.8 Flash,编码能力提升,在LMArena榜单险胜DeepSeek-V4-Pro,定价与3.7 Flash一致。其输出速度快,但有网友质疑是刷分。此外还有3.8 Flash Cyber,网络安全能力强却不公开发布。

量子位
开源动态8

重磅!DeepSeek再开源:视觉即压缩,100个token干翻7000个

DeepSeek-OCR模型探索视觉-文本压缩边界,用少量视觉token解码出10倍以上文本信息。它在OmniDocBench基准上表现超GOT-OCR2.0,为LLM长上下文问题提供方案,还能处理多类图像与近100种语言。

新智元
新闻资讯7

奥特曼:我承认GPT-5发布搞砸了

GPT-5发布堪称AI圈翻车现场,OpenAI一刀切下架其他型号后又加回GPT-4o。奥特曼承认搞砸,称学到为亿人升级产品的教训。他还有建数据中心、投资脑机接口等计划,也指出存在AI泡沫。

量子位
新闻资讯8

刚刚,GPT-5.2满分屠榜,OpenAI十周年王者归来

OpenAI 十周年推出 GPT - 5.2 系列模型,包括 Instant、Thinking 和 Pro 版本。它在多方面表现出色,刷新多项基准测试 SOTA 水平,如 AIME 2025 获满分,在 GDPval 达人类专家水平。还在编码、视觉理解等能力上有显著提升。

机器之心
开源动态7

1200行代码逆袭!DeepSeek工程师开源轻量级vLLM,吞吐量逼近原版

开源 vLLM 可提升 LLM 推理速度和资源利用率。近日,DeepSeek 工程师俞星凯开源轻量级 Nano - vLLM,代码仅 1200 行,基准测试中吞吐量逼近原版,项目已在 GitHub 获 200 多 Star。

机器之心
开源动态7

智谱GLM-5强调的Agentic Engineering能力是什么?|甲子光年

智谱上线并开源GLM - 5,在Coding与Agent能力上达开源SOTA,刺激股价上涨。它验证了Agentic Engineering可行性,提升能力阈值,但成本阈值也更显性,未来软件工程或分层发展。

甲子光年
算法论文8

7B打败o3、GPT-5!医学AI智能体让模型学会“看哪里、怎么看”

上海创智学院LeapQuest团队联合多校,在ICML 2026接收两篇论文,提出“Think with Images/Think with Videos”范式,让视觉证据参与模型推理,Ophiuchus和MedScope分别用于图像和视频诊断,表现出色。

量子位