DeepSeek V4」共找到 2242 篇相关文章

新闻资讯7

DeepSeek、GPT、Qwen,所有大模型架构图都有,Karpathy:宝藏画廊!

大模型赛道热闹,架构创新多,理解困难且缺清晰架构图。AI 研究者 Sebastian Raschka 绘制主流大模型结构,整理成在线图谱「LLM Architecture Gallery」,方便研究者查阅对比。

机器之心
新闻资讯7

英伟达叫板DeepSeek?怒投260亿美元,要打造最强开源模型

英伟达已成为人工智能时代基础设施的一部分,2023年11月推出首个Nemotron模型进入通用大模型领域。未来五年将投260亿美元构建开源模型,还发布了性能最强的开源模型Nemotron 3 Super。

机器之心
算法论文7

LLM也会emo,Claude玻璃心、Gemini社恐,Kimi/GLM/ DeepSeek如何?

华东师大和复旦大学研究8大模型家族是否有“情感链”。实验覆盖8大家族20+模型,发现各家族有独特“人设”,如Claude像“文艺青年”。还揭示模型在不同情境下的情绪变化及影响,给出实用建议。

PaperAgent
新闻资讯8

从MiniMax到DeepSeek:为何头部大模型都在押注「交错思维」?

昨日推特博主公布国内几大开源模型在 mini - SWE - agent 测试成绩,MiniMax 新一代大模型 M2 表现最佳。其采用的「交错思维」技术成亮点,解决了状态漂移问题,正成高性能 Agent 模型标配。M2 既强又省,还给出使用最佳实践。

机器之心
产品应用8

Claude Sonnet 4 支持百万上下文了,AI Coding 的想象力更大了

Anthropic宣布Claude Sonnet 4支持100万Token上下文窗口,容量为之前5倍。该功能已在部分平台公测,将推给更多用户。它支持复杂任务,有新定价和成本优化方案,获早期用户高度评价。

Founder Park
开源动态8

谷歌开源结构化信息提取神器!4K+ Star,精准定位+交互式可视化!

在医疗、法律等领域,手动从非结构化文本提取信息费力,传统NLP工具需复杂训练。谷歌开源的LangExtract是高精度信息抽取Python库,能自动提取结构化信息,有精确源定位等功能,还给出使用示例和典型场景。

开源星探
开源动态8

狂涨91.4K star!!号称是下一代Vim编辑器,体验超棒!

本文介绍开源项目Neovim,它是Vim分支,扩展性强、好用,内置终端模拟器,支持图形界面,与Vim插件兼容性好,还介绍其性能特色、安装配置方法及常用命令。

开源先锋
产品应用8

被低估的ChatGPT新功能,10分钟搞定DeepSeek代码库深度研究

ChatGPT悄悄上线直连Github新功能,能自动读取、解析并总结整个GitHub仓库,可快速输出专业研究报告,应用场景广,还能避免“幻觉”,Plus用户即可用,开启全新研究模式。

新智元
开源动态8

GLM-5.2 正式发布:开源之王来了,摸到了Opus-4.8

GLM-5.2正式发布,主打长程任务能力,有1M token上下文窗口且完全开源。它在长程任务基准评测中表现出色,与顶级闭源模型差距缩小,还解决了超长上下文计算成本问题,同时应对了模型‘作弊’情况。

AI寒武纪
新闻资讯8

4万字《壮丽人性》长文首发!教皇联手Anthropic,警告AI不能统治人类

2026年5月25日,教皇良十四世发布42300字AI通谕《壮丽人性》。Anthropic联创称大模型涌现人类情绪,人类无法理解。教皇指出AI核心危机,揭露剥削与数据殖民,反对AI用于战争,关注AI对工作的冲击。

新智元