内存压缩」共找到 397 篇相关文章

算法论文7

外国科学家从汉字中找到了设计超强材料的灵感!“天”字形材料最坚固

4月21日爱丁堡大学研究人员在《应用物理学杂志》发文,将“人”“大”“天”“夫”字形转化为超材料结构单元,经压缩实验发现汉字字形中藏力学规律,“天”字形材料性能最优。

DeepTech深科技
新闻资讯8

2026 编程巨变:Anthropic 报告揭示 Agent 编程八大趋势

Anthropic发布《2026 Agent编程趋势报告》,预测写代码将从‘人写’变为‘人指挥AI Agent写’。报告梳理八大趋势,分基础、能力、影响三类,还给出2026年需关注的领域,指出AI改变开发者工作内容。

宝玉AI
新闻资讯7

老黄200亿「钞能力」回应谷歌:联手Groq,补上推理短板

谷歌TPU威胁刚至,英伟达砸200亿美元联手Groq布局AI新时代。知名投资人指出Groq LPU推理速度远超GPU、TPU等,但内存容量小。英伟达借此补推理短板,入局竞争激烈的推理市场。

量子位
开源动态7

Glyph:文本转图片解决长上下文困境,智谱把“DeepSeek-OCR”具像化了

传统 token 扩展方式遇算力成本天花板,DeepSeek 与智谱都想到让 AI“看”文字思路。智谱发布 Glyph 框架工程化实现此思路,将文本转图片处理,降低计算成本,有不错效果但也存在排版敏感等限制。

AI工程化
开源动态7

被DeepSeek带火的OCR,最新8个开源模型盘点~

DeepSeek-OCR发布让OCR大热,PaperAgent梳理盘点8个热门开源OCR模型,如DeepSeek-OCR用‘上下文光学压缩’技术,Nanonets-OCR2-3B以零样本视觉链式思维为核心等。

PaperAgent
新闻资讯7

王兴兴回应比赛风波:挣到钱了,但现在的机器人别指望它能干活

2025北京智源大会上,宇树科技王兴兴、北京人形机器人创新中心熊友军等围绕具身智能探讨。提到机器人赛事能展示成果、促进行业发展;对机器人构型看法不一;还探讨了VLA泛化性等问题。

AI前线
开源动态7

极客说|Unsloth 的全微调之路:从 Adapter 到 Full Fine-tuning

大语言模型参数多,微调难。Unsloth 原靠支持 Adapter 微调出名,现支持全参数微调,单卡就能搞定大规模模型训练。文章介绍其进化历程、关键技术、工程部署、使用优势及最佳实践。

AIGC开放社区
产品应用8

1B 参数跑出 2B 性能?面壁 MiniCPM5-1B 用 AI 自进化,提速 AGI 进程

全球AI行业陷入资源消耗战,面壁智能绕开物理瓶颈,提出“AI制造AI”路径。2026年5月25日发布MiniCPM5-1B,有越级性能、极致压缩比和均衡能力,源于“模型、框架、数据”自进化范式。

AI科技评论
开源动态8

清华系团队出手!一张 4090 即可「爆改」,1.3B小钢炮震撼开源

5月11日,清华系团队面壁智能联合多方开源端侧多模态大模型MiniCPM-V 4.6。它参数仅1.3B,性能超阿里、谷歌等同级对手,效率翻倍,还实现两项架构创新,适配主流开源生态,降低开发门槛。

新智元
算法论文8

ACL 2026 | LCA:DeepSeek 长文本加速神器,90% KV 缓存缩减 + 2.5 倍推理提速

琶洲实验室等团队提出潜在空间压缩注意力(LCA),入选 ACL 2026。LCA 突破传统注意力机制瓶颈,适配不同大模型,降低硬件门槛与成本,提升推理效率。论文与代码已开源。

机器之心