「知识推理分离」共找到 2510 篇相关文章
CVPR 2026 Oral|横扫室内3D场景,港科大(广州)打造单目开放词汇占据预测新SOTA
具身感知核心难题待解,传统占据预测方法有局限。港科大(广州)陈昶昊教授团队提出 LegoOcc,首次实现单目开放词汇三维占据预测,在多方面展现优势,未来或让家用机器人精准定位目标。
The Batch: 942|暗基因组揭秘
AlphaGenome 能解读人类和小鼠基因组中 98% 不编码蛋白质部分,识别多项特征。它经预训练和知识蒸馏,在多项评测超早期模型,API 等免费用于非商业,助研究基因组与生物过程联系。
探针伸进大模型黑箱,南加州大学华人团队打造AI记忆研究的深空望远镜
南加州大学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控大模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示大模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。
硅谷前沿访谈:CUDA之父复盘英伟达20年护城河,揭开万亿算力帝国的底牌
奇点智能研究院院长李建忠采访了“CUDA 之父”Ian Buck,探讨 CUDA 20 年演进、英伟达技术产品及生态。Ian Buck 介绍了 AI 基础设施新阶段,阐述 CUDA 成功原因,还谈及英伟达软硬件协同、应对竞争等问题。
Soul App 又又又开源了!这次是实时交互数字人,支持小时级长视频甚至无限时长!
Soul App 新开源实时数字人项目 SoulX-LiveAct,解决 AR 扩散模型流式生成稳定性问题。它实现 20 FPS 实时流式推理,延迟 0.94 秒,支持无限时长,有恒定显存等亮点,可用于多场景。
太巅了!MIT老哥在Transformer里造了台计算机,LLM从此不需要调用外部工具?
LLM在数学推理表现佳,但纯计算是短板。MIT的Christos Tzamos团队在Transformer内造计算机,实现WebAssembly解释器,解决数独难题,还突破注意力机制瓶颈,打开软件与神经网络新接口。
刚刚,腾讯姚顺雨署名首篇论文发布,「下半场」先搞上下文学习
腾讯混元团队和复旦联合团队发布姚顺雨署名首篇论文《CL - bench》。论文证实模型在上下文利用上有能力短板,还构建了CL - bench评测基准,评估发现前沿模型在上下文学习上表现差,未来要让上下文学习走向现实。
大模型的第一性原理:(二)信号处理篇
本文从信号处理角度解读大模型原论文,探讨语义向量化原理,分析 Transformer 与 Granger 因果关系。指出大模型输入 Token 语义嵌入是将自然语言处理转化为信号处理问题,向量化与信号处理、信息论联系紧密。
解决算力瓶颈,给多模态瘦身!Token压缩完整图谱与选型指南
给多模态大模型瘦身是解决算力瓶颈的关键。Token压缩技术可剔除视觉冗余,提升训练与推理效率。北大等团队剖析其全貌,给出完整图谱与选型指南,还揭示了未来演进路径。
这几个开源项目火起来啦,抓紧收藏哟起来!!!
本文介绍三个热门开源项目。KnowNote 是本地优先的 AI 知识笔记工具,是 Google NotebookLM 开源替代方案;Remotion 让开发者用 React 技术栈制作视频;Superpowers 可让 AI 编程助手升级为智能开发伙伴。