不可压缩知识探针」共找到 741 篇相关文章

开源动态8

DeepSeek开源新模型,提出上下文光学压缩:LLM的新记忆方式

DeepSeek开源OCR模型,探索用多少视觉信息让LLM理解文本。实验表明1000字文档约需100个vision tokens,压缩比10倍、准确率97%。还提出模拟人类遗忘等想法,有多种应用场景,且完全开源。

花叔
开源动态7

DeepSeek-OCR降本增效,10×暴力压缩还能读得清

Deepseek - OCR模型发布,通过光学压缩技术解决长文本处理的计算效率问题,能控制大模型token消耗成本。介绍了其架构设计、数据引擎及训练流程,还展示其用较少token超越现有模型的能力。

CourseAI
算法论文8

时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8

在大语言模型发展中,Transformer自注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在多任务中表现出色,代码已开源。

机器之心
新闻资讯8

2年内AI生成世界90%知识!老黄2小时重磅访谈「剧透」未来

新智元报道黄仁勋2.5小时访谈,他透露2 - 3年内90%知识或由AI生成,强调AI尽头是能源,提出通用高收入概念,还分享英伟达危机、童年经历,解答AI意识、失控等问题。

新智元
开源动态7

超越ZIP的无损压缩来了!华盛顿大学让大模型成为无损文本压缩

华盛顿大学SyFI实验室提出LLMc,利用大型语言模型进行无损文本压缩。基准测试显示其压缩率优于传统工具,且项目已开源。不过,当前版本存在效率、吞吐量等问题,应用范围也主要在自然语言。

量子位
算法论文8

AST | 西工大马龙、邬晓敬等:几何特征知识驱动的代理优化方法

机器学习为气动外形设计提供新方法,但高效挖掘利用几何与气动数据知识是难题。本文提出气动监督自编码器架构,利用小样本气动数据监督学习几何特征,嵌入优化框架提升样本质量及优化效率,经翼型和机翼验证有效。

力学与人工智能
开源动态8

语音界Sora!微软刚开源新模型,一次生成90分钟语音、3200倍压缩

今天凌晨微软研究院开源创新音频模型VibeVoice - 1.5B,有诸多技术突破,如可合成90分钟语音、支持4名发言人、3200倍音频压缩等,还首创双tokenizer协同架构。未来微软还会开源更大参数模型。

AIGC开放社区
开源动态8

3天狂揽23.1k星!把代码库变成知识图谱,AI编程成本降低35%

CodeGraph是开源本地代码知识图谱工具,提前为项目建索引,组织代码信息,让Agent直接查询。能减少token消耗与工具调用、提高响应速度,数据本地保存,还具备多语言支持等特点。

开源AI项目落地
新闻资讯8

当Gemini 3刷屏时,这款AI已开始救命了:原子级攻克「不可成药」靶点

全网关注Gemini 3时,Chai-2已开启生物学界「AlphaFold时刻」。它能原子级精准设计出可进临床的抗体药,攻克「不可成药」靶点,让很多难治疾病看到新药希望,AI造药开始起飞。

新智元
开源动态8

两周复刻DeepSeek-OCR!两人小团队还原低token高压缩核心,换完解码器更实用

两人小团队仅用两周复刻DeepSeek-OCR,复刻版DeepOCR还原其低token高压缩核心优势,还在关键任务上追上原版表现。它完全开源,无需大规模算力集群,训练方案适配中小团队。

量子位