腾讯混元图像3.0」共找到 3351 篇相关文章

算法论文8

谢赛宁团队新作:不用提示词精准实现3D画面控制

谢赛宁团队新发布的Blender Fusion框架,结合图形工具 (Blender) 与扩散模型,让视觉合成不再仅依赖文本提示,实现精准画面控制。其核心是对现有技术高效组合,还透露两项训练技巧提升泛化性。

量子位
产品应用7

ComposeMe:让发型、服饰与身份随心组合的人体图像生成新范式

人像生成中保持效果清晰真实且自由调整细节是难题,Snap推出ComposeMe,引入‘属性特定图像提示’思路,能灵活组合属性。还建立数据集、提出训练方法,虽有局限,但表现较优。

带你学AI
产品应用8

编程能力开源SOTA,网络安全提升2倍!智谱发布GLM-5.3

智谱发布GLM-5.3,743B参数模型,编程能力达开源SOTA。网络安全能力涌现,基准得分是GLM-5.2两倍多。全部提升来自后训练缩放,还自研Z.ai Code Bench评估,安全评估加固后权重将开源。

AIGC开放社区
产品应用7

阿里云 Tablestore 基于 Mem0 为 OpenClaw 构建记忆系统最佳实践

文章指出 OpenClaw 原生记忆有失忆、多 Agent 记忆不通等问题,介绍阿里云 Tablestore 基于 Mem0 为其构建记忆系统的实践,包括优势、安装步骤,实测记忆持久生效,还提及后续实践值得期待。

阿里云开发者
新闻资讯7

大模型平台AI21 Labs获3亿美元D轮融资

Business Insider消息,大模型平台AI21 Labs获3亿美元D轮融资,由谷歌、英伟达领投。该公司创立于2017年,2025年3月推出新AI平台Maestro,可提升主流模型指令遵循准确性。

AIGC开放社区
开源动态8

重磅!鸿蒙平台首个全跨端APP ——腾讯视频ovCompose框架发布

腾讯视频团队推出跨平台开发框架ovCompose,弥补Compose Multiplatform不足。还推出KuiklyBase,涵盖多项鸿蒙适配等建设。该框架有高性能、支持混排等优势,已开源,未来将持续优化。

腾讯技术工程
新闻资讯7

时隔两月,Mistral AI终于上新Medium 3,近期还有「One more thing」

时隔两月,Mistral AI 推出 Mistral Medium 3,性能介于轻量级和大规模模型间,优于 GPT - 4o 等。未开源,可通过官网等使用,专为企业设计,成本低。还预告将推「大型」产品,同时推出企业聊天机器人 Le Chat Enterprise。

机器之心
新闻资讯7

神秘「欢乐马」霸榜视频模型!本以为Seedance2.0已封神…

神秘模型HappyHorse - 1.0悄然登顶Artificial Analysis的AI Video Arena排行榜,在多个赛道力压Seedance等模型,呈现断层式碾压。它或出自阿里淘天未来生活实验室,据说完全开源,10号将正式发布。

量子位
产品应用7

OpenClaw 2026.3.8更新:安全认证及部署回滚能力提升

OpenClaw发布2026.3.8版本更新,聚焦安全性与bug修复。关键更新有ACP来源验证,让代理确认指令来源;更新前自动创建配置快照,可回滚设置。还修复了Telegram重复回复等问题。

AI工程化
开源动态8

宇树科技开源UnifoLM-WMA-0机器人模型,离通用机器人又进一步

宇树科技开源UnifoLM-WMA-0模型,用神经物理网络让机器人理解力学规律。它支持两种模式,融合多模态信息,架构精妙。经测试性能强,已真机部署。开源降低门槛,有望推动行业发展。

AIGC开放社区