「DeepSeek团队」共找到 3992 篇相关文章
Claude爆火研究漏引华人团队成果,已挨打立正道歉
Anthropic新论文研究Claude“情绪机制”,漏引华人团队Chenxi Wang去年10月论文。经沟通,A社已道歉并更新博客引用。华人团队论文首篇系统研究LLMs情绪机制,解答核心问题,成果显著。
刚刚,DeepSeek开源OCR 2,首创Qwen编码的「双流架构」
年底 DeepSeek 开源新模型 DeepSeek - OCR 2,首创双流注意力架构,model&paper 一同发布。它重构视觉编码器,采用三阶段训练流程,在 OmniDocBench v1.5 评测及生产环境验证中表现良好。
刚刚,OpenAI想收购的Windsurf,被谷歌DeepMind抢走了核心团队
谷歌DeepMind宣布截胡OpenAI原本打算收购的Windsurf,其CEO与CTO发文欢迎Windsurf团队。此前OpenAI与Windsurf 30亿美元收购协议排他期已到期。Windsurf部分员工加入DeepMind,剩余团队将继续运营。
读完这篇,你就搞懂 DeepSeek v4 了
2026年4月24日,DeepSeek全新系列模型DeepSeek - V4预览版上线并开源,评分接近‘闭源三巨头’。该模型强在1.6T参数+1M上下文,还有从attention到kernel的系统级重构与优化,在架构和工程层面均有创新。
刚刚,DeepSeek论文登上Nature,更多细节披露!
9月17日,梁文锋担任通讯作者的DeepSeek - R1推理模型研究论文登《Nature》封面,它是全球首个经同行评审的主流LLM。不靠人工标注,靠强化学习激发推理能力,学会‘自我反思’,在多任务上优于传统模型。
DeepSeek又拿第一!首创「因果流」视觉推理,超越Gemini
DeepSeek开源DeepSeek - OCR2,引入DeepEncoder V2视觉编码器,打破传统模型扫描限制,模仿人类视觉「因果流」逻辑。它解决了传统VLM忽略图像语义结构问题,在多项测试中表现出色,还验证了「LLM作为视觉编码器」可行性。
深度拆解 DeepSeek Harness 架构:AGI 的自进化,终于有了「后悔药」
8月13日,DeepSeek开放DeepSeek Harness v0.1开发者预览版,在Github获4.5万星。它提出“一切皆插件”概念,核心组件可插拔。还联合北大提出Cordis框架,解决组件插拔问题,但面临价格与组件膨胀挑战。
DeepSeek招聘被「华为天才少年」公开吐槽,“面到最不专业的”
前华为天才少年李博杰公开吐槽DeepSeek招聘不专业,包括笔试后久不安排面试、面试官迟到态度轻佻、质疑其作弊等。今年DeepSeek大规模扩张,招聘要求高,但面试资源或难跟上。
浙大彭思达团队 × 理想最新研究:直面高分辨率深度的细节缺失
现有高分辨率深度估计方法在实际使用中存在局限,浙江大学彭思达团队联合理想研究团队提出论文《InfiniDepth: Arbitrary-Resolution and Fine-Grained Depth Estimation with Neural Implicit Fields》,构建实验验证了InfiniDepth在多方面的有效性。
大基金或将领投DeepSeek?算力拐点将至
5月6日报道国家大基金正洽谈领投DeepSeek首轮融资,估值约450亿美元。大基金此前未公开投资大模型公司,此次若落地是从“半导体硬件”向“AI应用端”延伸。2025年是中国AI芯片出货量关键年份,DeepSeek-V4发布,多家国产芯片品牌完成适配,但国产芯片仍面临性能、软件生态等挑战。