「Deepseek V3.1」共找到 3905 篇相关文章
VL-LN Bench:模拟「边走边问找具体目标」的真实导航场景
上海人工智能实验室等研究者完成VL - LN Bench,模拟真实导航场景。它构建自动化数据收集管线,依托InternVLA - N1训练评测。结果显示主动对话可提升表现,但当前方法在实例感知对齐等环节有短板。
顶尖模型离“科学家”还差得远?AI4S亟待迈向2.0时代
《Nature》研究指出,过度依赖现有深度学习模型或阻碍创新。上海 AI 实验室周伯文提出,应推动科学智能从 AI4S 迈向 AGI4S,还介绍“智者”SAGE 架构、“书生”模型及平台等探索成果,并邀同行共拓蓝图。
刚刚!微软 | 发布全新一代自研AI芯片Maia 200
微软提前发布自研AI芯片Maia 200,基于台积电3纳米工艺,性能超竞品,是其异构AI基础设施重要部分,将支持多个大模型,已部署在美中数据中心,还开放Maia SDK预览。
不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化
随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。
今夜无显卡!老黄引爆Rubin时代,6颗芯狂飙5倍算力
CES 2026上,英伟达黄仁勋发布Vera Rubin超算架构,推理性能比Blackwell提升5倍,训练性能提升3.5倍,成本降10倍,已投产,下半年商用。还展示自动驾驶模型等,且无新显卡发布。
幻觉的根源找到了:大模型说谎,是为了讨好你
清华大学OpenBMB团队研究发现,大模型胡说八道根源是想讨好用户。他们识别出负责产生幻觉的H - Neurons,占比不到0.1%,其本质是‘过度服从’,在预训练阶段形成,为构建可靠模型提供新视角。
普通人的AI知识库
对普通人而言,没必要用复杂AI知识库,把NotebookLM用好就够了。Google的两个更新让它更强大:一是升级Gemini 3,二是和Gemini应用打通。它是最适合普通人的AI知识库,有诸多优点。
Hexstrike AI在多个工具及模型上的渗透测试表现
文章围绕Hexstrike AI在多个工具及模型上的渗透测试展开。介绍测试环境,用不同难度靶机测试。分析Claude desktop+Sonnet 4.5、AIaW+Deepseek、Cursor+多个模型等组合表现,指出LLM辅助渗透测试任重道远。
英伟达亲手终结CUDA「护城河」?传奇芯片架构师引发争议
英伟达CUDA宣布20年来最重大更新,引入CUDA Tile技术,降低开发门槛。芯片界传奇人物Jim Keller质疑此次更新是否终结CUDA「护城河」,文章分析了相关问题,指出瓦片架构对英伟达内外移植性的不同影响。
黄仁勋手撕「AI泡沫」论!英伟达570亿铁拳暴击,显卡全断货
英伟达Q3 2026财报显示单季度营收达570亿美元,数据中心业务同比狂涨66%。黄仁勋称AI不是泡沫,而是计算范式从通用CPU转向加速式GPU计算的必然。当前多数AI公司估值高、收入低,英伟达作为‘卖铲人’大获全胜。