「论文推荐」共找到 1359 篇相关文章
装上这个Skill后,Claude Code联网能力直接拉满
Web Access 是给 Claude Code 用的 Skill,装上后 Agent 联网能力大幅提升。它解决了 Claude Code 原有联网工具的问题,有联网工具自动选择、CDP 浏览器操作等能力,还介绍了安装方式和设计哲学。
融资 1200亿后 Kimi 再扔王牌,新架构爆改 Transformer 老配件,比 DeepSeek 同款还省钱
Kimi 发布新论文,提出“注意力残差”架构改进 Transformer 残差连接,解决“稀释问题”,让 AI 更聪明、更省钱,还推出“分块注意力残差”优化成本。与 DeepSeek 方案对比,Kimi 方案性价比更高。
模型砍掉一大半,准确率反升15%!华科&阿里安全新研究实现ViT近乎无损的类特定压缩|ICLR'26
华中科技大学联合阿里安全部提出Vulcan方法,一改传统压缩策略,通过“先训练再剪枝”实现ViT近乎无损的类特定压缩,为大模型服务小场景提供新路径,论文已被ICLR 2026接收。
李飞飞团队新作:简单调整生成顺序,大幅提升像素级图像生成质量
长期以来,AI生图面临潜空间模型细节损耗、像素空间模型结构混乱速度慢的矛盾。李飞飞团队最新论文提出Latent Forcing方法,通过重排生成轨迹,让像素扩散模型找回效率并刷新SOTA。
AAAI 2026 Oral | 告别注意力与热传导!北大清华提出WaveFormer,首创波动方程建模视觉
北大清华团队在AAAI 2026 Oral论文中提出WaveFormer,首创用波动方程建模视觉。它将特征传播写成欠阻尼波动方程,实现频率 - 时间解耦,在多任务验证中速度、效率与精度全面超越。
人大高瓴赵鑫团队新作:先拆掉 RLVR,再重建推理模型训练
人大高瓴赵鑫团队围绕RLVR框架做系统实验,完成论文《A3PO: Adaptive Asymmetric Advantage Shaping for Reasoning Models》,提出A3PO方法。该方法将训练重点转向关键决策点,让推理模型学习更可控。
不止于量化:最新综述用「时-空-构」三维视角解构KV Cache系统级优化
随着LLM向1M上下文演进,KV cache成推理服务效率核心瓶颈。墨尔本大学和华中科技大学研究者发布深度综述,用「时间 - 空间 - 结构」视角梳理KV cache优化方法,还归纳关键观察、提出开放挑战,并整理了资源库。
国家级舞台,为你备好!首届“无限可能”AI短片创投计划-首创郎园专属投递通道正式开启!
首届“无限可能”AI短片创投计划由中制协主办,首创郎园开启推荐报名通道。该计划面向全球征集作品,分三阶段进行,旨在推选扶持AI创作者与项目,促进AI影视产业发展。
5.3 万人收藏的开源版 Claude Code 彻底起飞了,GLM-4.7直接免费用。
近期AI编程界,Claude Code虽好用但对小白不友好。而开源神作OpenCode爆火,Star数达53K。它把‘选模型’进化成‘选员工’,有图形化界面,还集成可靠模型,支持并行运行,社区有强大插件。
独立开发者必看,前端人想做低代码?先把这个 5k star 可视化拖拽编辑器 Demo 跑起来
`visual-drag-demo`是开源可视化拖拽编辑器Demo,偏前端与低代码方向。它把编辑器必备功能做成教学项目,适合想做搭建器、可视化配置等的人快速摸清实现方法,功能丰富,学习成本低。