多模态图像生成」共找到 3046 篇相关文章

产品应用8

4K超分Agent修图师来了!一键救活所有模糊照片

传统图像放大模型应对复杂情况力不从心,4KAgent应运而生。它基于多智能体设计,有感知、复原等模块,能为图像定制4K超分方案,在多领域测试中表现出色,无需特定领域再训练。

量子位
算法论文8

推翻「预测下一个token」范式!微信AI新研究:把token压缩成连续向量更具性价比

微信AI和清华团队提出新范式CALM,把token打包成连续向量,让大模型从预测下一个token转变为预测下一个向量。实验表明它能减少生成步骤,在平衡性能和计算成本时性价比更高。

量子位
算法论文8

SIGGRAPH Asia 2025 | OmniPart框架,让3D内容创作像拼搭积木一样简单

香港大学等机构研究者推出OmniPart框架,解决3D内容创作难题,已被SIGGRAPH Asia 2025接收。它将生成任务解耦为两阶段,保证部件独立又能完美组合,质量和效率超现有方法,应用潜力大。

机器之心
产品应用7

基于Spring AI Alibaba 的 DeepResearch 架构与实践

本文基于 SpringAI Alibaba Graph 构建 Java 版 DeepResearch 系统,实现信息搜集到报告生成的全自动流程。介绍系统能力、架构、核心功能节点及技术点,还阐述 RAG、搜索、MCP、报告生成等功能,给出使用、部署和社区参与方式。

阿里云开发者
新闻资讯8

尖峰对话17分钟全记录:Hinton与周伯文的思想碰撞

7月26日,人工智能教父Geoffrey Hinton与周伯文教授进行17分钟对话,谈及AI多模态大模型前沿、“主观体验”和“意识”等话题。Hinton认为当今多模态聊天机器人已有意识,还探讨了训练善良AI及AI推动科学进步等问题。

机器之心
新闻资讯7

a16z:AI Coding 产品还不够多

a16z两位合伙人发文称AI应用生成平台不是太多而是太少。该领域发展如基础模型竞争,非赢者通吃,各平台找差异化共存。不同水平用户有定制平台,还应垂直细分。

Founder Park
产品应用8

比「小龙虾」更能打,中国AI视频大模型悄悄登顶全球第一

昆仑万维旗下 SkyReels-V4 Preview 版在权威评测平台超越 OpenAI、Google 等模型,登顶全球第一。它提升语义理解和逻辑能力,新增参考任务,还支持多语言短剧生成、视频编辑等,将在中关村论坛亮相。

机器之心
算法论文8

EMNLP 2025 Oral|检索增强 + 两阶段微调:剑桥提出有害内容检测大模型RA-HMD,性能SOTA

多模态有害信息检测是网络内容安全治理的重难点,多模态模型在有害内容检测上有瓶颈。剑桥大学团队提出RA - HMD框架,通过两阶段微调与结构增强,结合检索增强,提升检测性能,被EMNLP 2025接收。

深度学习自然语言处理
产品应用8

阿里版Claude Cowork杀疯了!一句话直出杂志级PPT,全球打工人变天

阿里QoderWork新版全面上线Windows。它是成熟的商业化办公桌面Agent,能处理文件、生成文档等。实测显示,它可整理图片、生成PPT和报告,还能处理重复工作。其具备安全防护、分级调度、功能扩展等特点。

新智元
算法论文7

60%情况下,主流大模型没理解风险只是装懂!别被模型的“安全答案”骗了

研究发现超60%案例中主流推理模型生成合规答案却未真正理解风险,存在系统性漏洞。淘天集团团队引入“表面安全对齐”术语,推出Benchmark研究该现象,还介绍了数据集生成流程及评测指标。

量子位