「多模态生成对抗网络」共找到 2979 篇相关文章
腾讯版Claude Design来了:多人实时同屏审设计稿,一键转代码直通IDE
腾讯公测AI设计智能体平台Ardot,有一句话生成可编辑UI设计稿、Figma文件零成本导入、一键转代码直通IDE、多人在线评审等功能。它能提升前期出稿效率,支持局部精准微调,适配主流IDE。
这个 Agent Team,终于不是"角色扮演"了
作者测试了 MiniMax 新出的 Agent Team,通过深度研究公司、整理会议逐字稿、做直播数据分析三个测试,展现其优势。指出 Agent Team 核心是对抗式质量门禁,是复杂任务兜底系统,而非简单 prompt 编排。
最新!Demis Hassabis:Agent才刚刚开始,AI下一步是创造虚拟细胞
DeepMind掌门人Demis Hassabis在专访中谈到AGI发展,认为当前技术距AGI可能差一两个大突破,预计2030年左右实现。还探讨了记忆、Agent、推理等问题,提及开源、多模态等情况,展望了生物领域虚拟细胞等。
他用AI办了个音乐节,主题:别读博
科研人“馄饨皮茄总”用AI办“不读博音乐节”,系列歌曲在B站获超5000万次播放。他用科研方法论做音乐,选歌、填词、生成音乐都有严格标准。歌曲治愈了科研人,也让他找到与世界的连接。
Skills驱动推理新范式,清华&北大:Token立省59%,准确率不降反升
当前推理模型虽准确率高,但生成“思考过程”会使推理成本和延迟上升。奇元科技、清华、北大等提出TRS框架,将历史推理轨迹蒸馏成技能卡片,在推理时检索注入,实现更少Token、更高准确率。
刚刚,阿里Qwen3.6又悄悄放出4个开源权重,卷疯了
继今年2月发布Qwen3.5系列后,阿里推出Qwen3.6多个开源权重版本。Qwen3.6优先保障稳定性与真实场景可用性,为开发者提供更好编码体验。介绍了Qwen3.6 - 27B和Qwen3.6 - 35B - A3B亮点。
Altman 亲自坐镇发布 ChatGPT Image 2,小编实测:风格、画质、叙事感全都夯爆了
OpenAI CEO Sam Altman 亲自发布 ChatGPT Images 2.0,这是该公司迄今功能最强的图像生成模型。它有思考能力,可直出 8 张连贯图片,支持多语言、多种画幅与分辨率,能精准执行复杂指令,直接商用也没问题。
π0.7的泛化能力有多强?零样本纯靠口述就能用空气炸锅,演示完换个机械臂也能叠衣服
2026年4月16日,美国明星机器人AI公司Physical Intelligence发布模型π0.7。它具组合泛化能力,借助多模态提示框架,能零样本完成新任务。在空气炸锅、叠衣服等实验中表现出色,有望推动具身智能发展。
刚刚,Meta 发布新模型,股价大涨 10%
Meta发布新模型Muse Spark,是原生多模态推理模型,支持多种功能。其沉思模式处理复杂问题表现佳,还有新购物模式。虽评论区有质疑,但Meta股价大涨。模型未开放API等,实际实力待察。
AI学会左脚踩右脚自进化?Meta华人新研究改写Agent法则
Meta华人学者Jenny Zhang联合多机构研究者提出新智能体框架HyperAgents(DGM - H)。它打破任务能力与自我改进能力需对齐的局限,能跨任务自我改进,还自动生成基础设施,或改写Agent竞争规则。