「深度压缩自编码器」共找到 984 篇相关文章
ICML'25 | 告别手动SFT!一句话得到你的专属大模型LoRA
传统微调方法开销大、部署难,Text-to-LoRA (T2L) 框架应运而生。它基于自然语言指令对 Transformer 模型即时适配,有三种架构变体,采用两种训练方法,实验显示其在多维度表现有效。
MIT工科生跨界AI,独作论文登Nature:只需3.5小时修复600年前名画
MIT理工男Alex Kachkine跨界艺术,独作论文登Nature。他设计的AI算法将名画修复时间从数月/数年压缩至几小时,提出“以数字方式修复一幅画,并在物理上实现效果”的新方法。
对话西工大徐韬:昇腾生态如何为AI创新装上涡轮增压?|甲子光年
本文讲述西工大徐韬团队与昇腾平台深度合作的故事。他们从算子研究攻坚底层技术,开发抑郁症初筛等系统。昇腾还助力教学,让学生实践操作。未来,更多人将参与国产AI源头创新。
性能翻番背后:讯飞与昇腾,如何用国产算力炼就大模型?|甲子光年
在全球AI竞争激烈背景下,科大讯飞与华为昇腾深度合作意义重大。双方合作历经四阶段,实现性能提升与技术突破,还通过软硬件协同构建AI自主发展竞争力,加速大模型行业落地。
字节跳动开源文档解析大模型Dolphin,告别繁琐的文档处理,上线狂揽1k星,真是绝了!
字节跳动开源文档解析大模型Dolphin,采用两阶段分析 - 解析范式,有异构锚点提示等功能,适用多领域。技术架构基于视觉 - 编码器 - 解码器,训练集超3000万个样本,安装推理简单,比同类更具竞争力。
破解300年数学难题,智能体大突破!谷歌发布超强AI Agent
今天凌晨谷歌Deepmind发布编程AI Agent——AlphaEvolve,它与Gemini深度集成,能评估算法。它解决了300多年的数学难题,还提出新算法,提升大模型计算效率,可优化GPU指令,架构含多模块。
吴恩达开源的OpenWorker,为什么「不 Work」了?
美国时间7月23日,吴恩达与Rohit Prasad发布开源桌面Agent OpenWorker。它把Agent工作流压缩成桌面应用,但上线一周暴露出多模型兼容、数据流向和权限控制等问题,反映出Agent赛道走向成熟产品的挑战。
从“被 AI 取代”到“用 AI 重构组织”,奇点智能产品大会聚焦产品、组织与商业重塑这些真问题
7月17 - 18日,CSDN与奇点智能研究院联合举办「2026奇点智能产品大会」,围绕十二大专题展开。主会场跳出模型竞赛,多位行业大咖将分享见解、深度讨论,还准备了AI产品落地资料包。
中国造出一颗「不怕死」的AI大脑,专接最要命的活儿
全球首个搭载AI大脑的防爆机器人“若愚揽月01”接管加油站,其“若愚九天”机器人大脑深度整合多模块,采用双系统,实现“脑+体”合一,可迁移至多场景,成立三年成果显著,欲做机器人时代“智能内核”。
ICLR最佳论文:Transformer天生简洁
2026年ICLR最佳论文对Transformer做深度思维体检,指出其架构真正威力在于描述概念时比RNN等简洁指数级甚至双重指数级,但验证其内部逻辑计算成本高昂,为解释其能力开新窗。