DeepSeek-V4.1」共找到 3245 篇相关文章

推荐文章7

当我问deepseek有什么延长周末的好方法

作者询问DeepSeek延长周末的方法,其给出工作日压缩、周末扩容、心理延展、进阶管理等策略,还介绍建立“时间折叠”意识,不少豆友分享实践感受。

每日豆瓣
产品应用8

自媒体误读了 DeepSeek-OCR:一图胜千言

近期,DeepSeek-OCR引发关注,但很多媒体误读其为OCR工具,实际是视觉语言模型。它是为大文档等场景优化的视觉压缩与识别系统,架构新颖,训练讲究,效果出色,为行业带来新思路。

MacTalk
新闻资讯8

刚刚,Claude Sonnet 4.5重磅发布,编程新王降临!

北京时间今天凌晨,Anthropic发布Claude Sonnet 4.5,被定义为全球最强代码模型。它在多方面有显著突破,Anthropic还对全线产品更新,其在多项测试表现出色,且对齐性更好、更安全。

新智元
算法论文8

北大DeepSeek论文或预定ACL Best Paper!梁文锋署名

北大DeepSeek联合发布的NSA论文已被ACL 2025录用且评分高,有望冲击最佳论文。该技术革新传统注意力机制,提升算力效率,是长文本处理的突破。此外,张铭教授团队还有多篇论文上榜。

新智元
开源动态7

3.3k星星爆火!Claude Design开源升级版,中文本地化,支持DeepSeek V4

Anthropic发布的Claude Design能生成UI、人机协作,但国内无法使用且不能用自己的API。Open-codesign是其开源本地化平替方案,支持多模型,功能丰富,保密性好。

开源AI项目落地
开源动态7

GPT-5得分不到0.4!法律+金融最大规模基准:1.9万+专家评估准则

新推出的PRBench基准可测AI在金融和法律领域表现。它有19356条专家评估准则,是该领域最大公开基准。顶尖大模型在困难子集得分低,还独创经济路径分析维度,约30%任务为多轮对话,揭示了AI在专业领域的不足。

新智元
开源动态8

刷新复杂Agent推理记录!阿里通义开源网络智能体超越DeepSeek R1,Grok-3

互联网信息检索中,复杂问题让普通开源模型力不从心。阿里通义实验室提出WebSailor方案,通过SailorFog - QA数据集和DUPO算法等创新,提升模型能力,在多基准测试中超越诸多开闭源模型。

量子位
新闻资讯7

狙击Gemini 3!OpenAI发布GPT-5.1-Codex-Max

Gemini 3力压全场,OpenAI发布GPT-5.1-Codex-Max应对。它突破上下文窗口限制,能连续工作超24小时,在METR达新SOTA,推理更快,还推出xhigh推理力度选项,已支持与多种工具结合。

量子位
新闻资讯7

刚刚,DeepSeek 文档更新,Agent 开发者要注意这个字段

DeepSeek在官方API文档给出thinking mode和tool call结合样例,把模型中间思考过程成Agent系统需管理部分。关键字段`reasoning_content`从调试信息成协议流程一部分,影响状态管理、多模型适配等。

AI科技评论
开源动态8

1万亿参数Ling-1T开源,国产LLM牛了~

Ling-1T是Ling 2.0系列首款旗舰“非思维”模型,总参数量达1万亿。预训练数据超20万亿token,支持128K上下文长度。在多项任务中表现出色,是目前已知最大的FP8训练基座模型,已完成全面评测。

PaperAgent