DeepSeek - V3.1 - Base」共找到 3749 篇相关文章

算法论文8

不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化

随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。

机器之心
新闻资讯8

今夜无显卡!老黄引爆Rubin时代,6颗芯狂飙5倍算力

CES 2026上,英伟达黄仁勋发布Vera Rubin超算架构,推理性能比Blackwell提升5倍,训练性能提升3.5倍,成本降10倍,已投产,下半年商用。还展示自动驾驶模型等,且无新显卡发布。

新智元
算法论文8

幻觉的根源找到了:大模型说谎,是为了讨好你

清华大学OpenBMB团队研究发现,大模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。

AI工程化
产品应用7

普通人的AI知识库

对普通人而言,没必要用复杂AI知识库,把NotebookLM用好就够了。Google的两个更新让它更强大:一是升级Gemini 3,二是和Gemini应用打通。它是最适合普通人的AI知识库,有诸多优点。

newtype AI
产品应用7

Hexstrike AI在多个工具及模型上的渗透测试表现

文章围绕Hexstrike AI在多个工具及模型上的渗透测试展开。介绍测试环境,用不同难度靶机测试。分析Claude desktop+Sonnet 4.5、AIaW+Deepseek、Cursor+多个模型等组合表现,指出LLM辅助渗透测试任重道远。

AI与安全
新闻资讯7

英伟达亲手终结CUDA「护城河」?传奇芯片架构师引发争议

英伟达CUDA宣布20年来最重大更新,引入CUDA Tile技术,降低开发门槛。芯片界传奇人物Jim Keller质疑此次更新是否终结CUDA「护城河」,文章分析了相关问题,指出瓦片架构对英伟达内外移植性的不同影响。

新智元
新闻资讯8

黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货

英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值高、收入低,英伟达作为‘卖铲人’大获全胜。

新智元
开源动态8

MeshCoder:以大语言模型驱动,从点云到可编辑结构化物体代码的革新

生成式AI在三维空间面临挑战,传统3D生成成果粗糙难编辑。团队推出MeshCoder,将三维输入翻译成结构化代码,有分部件生成等优势。介绍其实现路径、实验性能,也指出局限并展望未来。

机器之心
推荐文章7

一文读懂:GPU之间是如何进行互联的?

文章介绍GPU互联技术发展,从早期SLI、CrossFire到双GPU卡,再到英伟达NVLink协议。详述NVLink 1.0 - 5.0各代升级,还提及DGX、HGX平台差异,以及NVIDIA GB300 NVL72超节点特点等。

芯师爷
开源动态8

从今天起,开源前五,全!是!中!国!大!模!型!

短短一年,LMArena开源模型榜单前五全被中国大模型占领,智谱Z.ai登顶,阿里、DeepSeek等紧随其后。LMArena是权威评测平台,盲测机制保证排名真实。中国模型性价比高,正用开源和低价占领市场。

AGI Hunt