变分自编码器」共找到 1170 篇相关文章

开源动态8

设计师集体沸腾!阿里开源千问图像编辑模型,支持语义及外观的双重编辑!

阿里Qwen团队于2025年8月18日发布Qwen-Image-Edit模型,基于20亿参数的Qwen-Image模型,结合Qwen2.5-VL和变分自编码器,支持语义及外观双重编辑,能精准修改文字,已上线Qwen Chat等。

开源星探
开源动态8

腾讯纯文本LLM训视觉encoder,拿捏图表长视频,达到开源小模型SOTA!

腾讯开源Penguin - VL,直接用纯文本LLM训视觉编码器,跳出传统多模态拼接套路。在2B/8B紧凑参数规模的复杂任务中竞争力强,训练三阶段,相关代码、模型等已开放。

量子位
新闻资讯7

用户集体大逃亡!Cursor“自杀式政策”致口碑崩塌:“补贴”换来的王座,正被反噬撕碎

很多开发者吐槽和弃用 Cursor,其付费后砍功能、技术差、营销成“障眼法”,引发信任危机。部用户转向 Claude Code,AI 编程工具竞争焦点升级,未来有向智能体演进等趋势。

InfoQ
新闻资讯7

AI 进展的速度开始放缓了吗?

近期 AI 舆论场有三个微妙位移,失业讨论少、股票讨论多、进展讨论降温。其实 AI 进展可拆成叙事、能力、资本三个不同步的时钟,其整体速度未降,还给出截至 2026 年年中受冲击最大的十个行业清单。

AI Reading Hub
算法论文8

大模型顿悟原理!Meta新论文说清楚了

Meta超级智能实验室(FAIR)最新论文把大模型顿悟(grokking)现象的数学机制说清楚了。提出Li2数学框架,将两层神经网络的grokking动态三阶段,还推导了泛化缩放定律等。

AI工程化
新闻资讯7

Claude降智实锤了!还相涨价,Opus跌下神坛

AMD高级总监审计发现Claude处理复杂任务能力差,第三方跑排名下降。官方称调整是为平衡速度与成本,但用户认为是相降智。此外,企业包月套餐涨价,而Anthropic将推Opus 4.7和新设计工具。

量子位
产品应用8

实测可灵3.0 - 属于每个人的导演时代。

可灵更新至3.0版本,将视频模型能力提升到新高度。它有镜和语言两大升级方向,还升级了Omni模型。可灵3.0适合文生视频等,3.0 Omni擅改视频,二者结合能覆盖多数视频生成场景。

数字生命卡兹克
算法论文8

西交大提出QQWorld:仅需10行代码,世界模型成功率提升5.33个百

2026 年 3 月 Yann LeCun 等人提出 LeWorldModel,西安交通大学研究团队发现其存在问题,进而提出 QQWorld,用位数—位数匹配替换原有的 EP 正则,提升了规划成功率,还提出 Cross - Batch QQ 解决显存问题。

机器之心
开源动态8

刚刚开源就收藏 1000+ 收藏的 DeepSeek Harness 橙皮书,它把Harness拆解个遍!

DeepSeek Harness开源同日,《DeepSeek Harness:从开机到拆开》上线。作者花叔实测记录大量官方文档未写的细节,如完整系统提示词、出厂启动清单等,全书四部,获取方式简单。

开源星探
开源动态7

vLLM 新特性:批量大小不再影响模型输出

vLLM 推出批量不推理功能,解决大模型推理中相同输入在不同批量大小下结果不同的问题。设置 `VLLM_BATCH_INVARIANT=1` 可保证输出一致,技术实现含三部,虽有性能开销但换来了结果确定性。

AI工程化