变分自编码器」共找到 1169 篇相关文章

算法论文8

PRSA 2025 | RPI Nithin Somasekharan、Shaowu Pan(潘韶武):突破柯尔莫哥洛夫屏障——面向模型降阶的可学习加权混合自编码器

本文将线性POD与非线性Autoencoder通过可学习参数融合,提出可学习加权混合自编码器架构。在多数据集验证中,该方法克服了POD和纯AE的局限,在复杂PDE系统预测中表现出色,或可降低大规模计算成本。

力学与人工智能
算法论文8

MoCa:首个大规模双向多模态表征模型

为解决VLM用于嵌入的痛点,中国人民大学等机构研究者提出MoCa框架,可将单向注意力VLM训练成双向多模态编码器。它两阶段,实验效果好,未来可拓展模态、提升多语言适应等。

PaperAgent
算法论文8

坏了,我成AI的乙方了!Anthropic论文爆火,谁还敢无脑Copy?

Anthropic开年论文实锤AI让程序员傻,用AI辅助的人比纯手写只快2钟,且测验平均低17%。研究将工程师使用AI的交互行为归纳为五种模式,指出主动拷问AI才能进化,高者会主动制造障碍。

新智元
算法论文8

突破Pass@1瓶颈:一种让LLM自我博弈、永不枯竭的RL新范式,超越基线22.8%!

近年来,基于可验证奖励的强化学习(RLVR)在提升大型语言模型(LLM)推理能力上有关键作用,但存在熵崩溃问题。论文提出SVS创新策略,让模型自我合成问题形成自我提升循环,实验效果惊人。

深度学习自然语言处理
算法论文8

清华大学x生数科技:从波形到隐空间,AudioLBM引领音频超新范式

音频超辨率是提升音频体验的关键技术,但高频细节损失是挑战。OpenAI的Sora 2树立高保真音频生成标杆,现有学术模型有局限。清华与生数科技团队发表两项成果,AudioLBM展现通用高辨率音频生成潜力。

量子位
新闻资讯7

刚刚,奥特曼发布GPT-5!人人免费用「博士级」智能,基准图错误遭全网吐槽

OpenAI 发布 GPT - 5,奥特曼连发推文介绍看点。它是集成模型,有免费版、Plus 和 Pro 计划,多领域跑亮眼。不过直播现小 bug,跑图出错,马斯克拆台,表现未达部人预期。

机器之心
7

国产大模型高考出了:裸683,选清华还是北大?

字节跳动Seed团队公布全球第一梯队大模型“高考成绩”,Gemini理科655排第一,豆包文科683排第一、理科648排第二。文章解析评测标准,析各科目表现,还介绍豆包能力提升技术亮点。

量子位
新闻资讯7

2026年,AI初创全球化的「与不」|沙龙招募

当OpenClaw掀起开源浪潮、Agent应用频现,AI团队面临全球化命题。量子位将发起出海沙龙,聚焦出海早中期决策与路径,招募全球化实践者、参与者和投资机构,设置多环节交流。

量子位
新闻资讯8

GAIR 2025 「数据&一脑多形」论坛,激辩 AI 演进路径

在 12 月 13 日 GAIR 大会“数据&一脑多形”论坛上,探讨了数据价值重构与“一脑多形”架构革命。多位嘉宾围绕具身智能数据、“一脑多形”技术展开享与讨论,为人工智能发展提供新思路。

AI科技评论
产品应用8

Spec 退场,skills 上位:Codex 团队的产品方法论

文章介绍了OpenAI Codex团队产品方法论的化,从重视spec转向skills,开发从“描述过程”转向“组织能力”。还谈及Codex app开发、团队协作等,指出模型强后工作模式转,职业边界模糊,团队招人看重主动性。

InfoQ