「DeepSeek V3」共找到 2715 篇相关文章
刚刚!Qwen3深夜升级,碾压Kimi K2和DeepSeek V3
通义千问更新旗舰版Qwen3模型,推出Qwen3 - 235B - A22B - Instruct - 2507 - FP8。新模型通用能力显著提升,在多测评中超Kimi - K2等模型,还增强多语言覆盖等性能,已在魔搭和Hugging Face开源。
刚刚,DeepSeek V4 Pro正式版发布!
周三晚间,DeepSeek 突然发布 V4 Pro 大语言模型正式版,命名为 DeepSeek - V4 - Pro - 0813,官方未调升 API 使用价格。有用户称调用的 V4 Pro 思维链风格有变,跑分显示其 Agent 评测表现可媲美顶级模型,还撞车了马斯克的 Grok 4.6。
DeepSeek-V4-Flash正式版发布并开源,全面超越V4-Pro预览版
DeepSeek-V4-Flash正式版发布并开源,这一304B轻量级模型经后训练,性能远超V4-Pro预览版,与Claude Opus-4.8接近。模型权重开源后上Huggingface趋势榜第二,性价比高,实测表现佳。
真香!我用AI做PPT的血泪史:从“能用”到“真香”,V3版到底解决了什么?
作者因公开分享需做PPT,尝试多种AI PPT工具后,自己围绕Agent攒了一个。从V1到V3版不断改进,V3用多Agent提示词用法,风格多样且规则减少,还给出3步制作PPT的方法及后续功能拓展想法。
DeepSeek最新模型意外泄露~
DeepSeek最新模型DeepSeek-V3-0526疑似泄露,消息源于https://docs.unsloth.ai/basics/deepseek-v3-0526-how-to-run-locally ,其性能媲美GPT - 4.5 / Claude Opus,或成最强开源模型,信息若属实将很快发布。
刚刚,梁文锋被曝史上首次融资!DeepSeek V4彻底摆脱英伟达
外媒曝出DeepSeek正寻求首次外部融资,以不低于100亿美元估值筹集至少3亿美元。V4规模和野心远超前代,参数量达万亿,将运行在华为昇腾芯片上,若成功将脱离英伟达生态。
DeepSeek-V4蓄势待发!梁文锋署名论文或开启第二个DeepSeek时刻
据报道,DeepSeek将于2月发布新一代旗舰模型DeepSeek V4,其编程能力或超Claude和GPT系列。最新论文提出Engram条件记忆机制,分离死记硬背与逻辑推理,揭示新稀疏性分配定律。
DeepSeek 新模型 R1-0528 悄悄开源,与o3 相当,实测来了。
DeepSeek团队悄无声息地在Hugging Face上开源推理模型新升级版DeepSeek R1-0528,基于DeepSeek-V3-0324模型,架构和训练方法有改进,性能与o3相当,实测表现不错。
DeepSeek新模型DeepSeek-V4-Lite-285B测试曝光:“大海捞针”召回率100%
社区消息显示DeepSeek正测试新模型DeepSeek - V4 - Lite - 285B,用OpenAI MRCR 8 - pin标准考察超长上下文信息检索能力。测试结果优异,但‘大海捞针’法或被DSA作弊,实际效果存疑,社区高度关注其进展。
DeepSeek出品,必是精品!DeepSeek-OCR 2发布:让LLM像人一样读懂复杂文档,效果超Gemini 3 Pro
DeepSeek推出DeepSeek-OCR 2,提出“视觉因果流”,以全新视觉编码器赋予模型因果推理能力。它在文档解析基准表现超Gemini 3 Pro,代码和模型权重已开源,为2D推理和原生多模态探索铺路。