混元图像2.0模型」共找到 8834 篇相关文章

算法论文8

华为新架构砍了Transformer大动脉!任意模型推理能力原地飙升

即便Transformer是AI世界基石,但遇到复杂数学题或多步逻辑推理时表现不佳。问题出在Attention机制。华为诺亚方舟实验室推出Nexus高阶注意力机制架构,能提升模型推理能力,且参数零增。

量子位
算法论文8

AAAI 2026 Oral|LENS:基于统一强化推理的分割大模型

文本提示图像分割技术有战略意义,但基于监督式微调的方法有泛化能力瓶颈。为此引入LENS框架,采用强化学习机制,还介绍其架构、奖励机制,该框架在测试中表现优异,代码已开源。

机器之心
开源动态7

Rx.NET 7.0 拆分 Windows UI 支持,大幅缩减应用部署体积

Rx.NET 7.0 发布,重点为缩小 Windows 应用部署体积。它将 WPF 等集成功能从核心包拆分,解决自包含应用框架依赖问题。虽有破坏性变更,但维护团队保证了一定兼容性。后续有新开发计划。

InfoQ
开源动态8

EmbodiChain开源,用100%生成式数据自动训练具身智能模型

跨维智能开源EmbodiChain,它是通往GS - World的基石,重构具身智能学习范式。其以100%生成式仿真数据训练机器人,突破数据瓶颈,还对比了不同路线,测试显示其模型效果佳。

机器之心
新闻资讯8

刚刚,OpenAI 发布 GPT‑5-Codex 新模型,专为编程而生

OpenAI 发布专为 Agent 编程优化的 GPT-5-Codex 新模型,在动态思考、性能、代码审查等方面表现出色。同时,Codex 平台大升级,集成 GitHub,保障安全隐私,还公布了定价与可用性。

AGI Hunt
开源动态8

Sora2还在5秒打转,字节AI生视频已经4分钟“起飞”

字节和UCLA联合提出Self - Forcing++方法,无需更换模型架构或重收集数据集,就能生成分钟级长视频,最长达4分15秒,高质量且开源,在长、短时长生成上性能领先。

量子位
产品应用7

ComposeMe:让发型、服饰与身份随心组合的人体图像生成新范式

人像生成中保持效果清晰真实且自由调整细节是难题,Snap推出ComposeMe,引入‘属性特定图像提示’思路,能灵活组合属性。还建立数据集、提出训练方法,虽有局限,但表现较优。

带你学AI
开源动态7

用开源中转统一接入Claude/OpenAI/Gemini:Sub2API核心功能解析

若同时用Claude、OpenAI、Gemini等,会面临账号分散、API Key管理难等问题。Sub2API是开源一站式中转服务,能统一接入这些订阅,还具备多账号管理、精确计费等功能,有多种部署方式。

小华同学ai
产品应用8

编程能力开源SOTA,网络安全提升2倍!智谱发布GLM-5.3

智谱发布GLM-5.3,743B参数模型,编程能力达开源SOTA。网络安全能力涌现,基准得分是GLM-5.2两倍多。全部提升来自后训练缩放,还自研Z.ai Code Bench评估,安全评估加固后权重将开源。

AIGC开放社区
产品应用7

阿里云 Tablestore 基于 Mem0 为 OpenClaw 构建记忆系统最佳实践

文章指出 OpenClaw 原生记忆有失忆、多 Agent 记忆不通等问题,介绍阿里云 Tablestore 基于 Mem0 为其构建记忆系统的实践,包括优势、安装步骤,实测记忆持久生效,还提及后续实践值得期待。

阿里云开发者