混元图像3.0」共找到 3106 篇相关文章

Product Application7

Wan 2.6 发布,可以参考视频进行角色扮演 & 终于有积分了:每天 150

Wan 2.6发布,积分从每天10个提升到150个。更新了主演、多镜头叙事、图像生成等新功能,如可将参考视频角色放入新场景,简单提示自动生成多镜头叙事视频等。

AI进修生
开源动态8

Google 把翻译能力彻底开源了!TranslateGemma:550种语言通吃,还能直接看图翻译!

Google将多年积累的翻译能力灌进开源大模型TranslateGemma,它基于Gemma 3,专为翻译任务调优,有3个规模版本,覆盖550种语言,能直接看图翻译,亮点颇多。

开源星探
新闻资讯7

突发!英伟达正式以129亿美金收购抱抱脸:不强制使用自家算力,马斯克送祝福

英伟达宣布以129.3亿美元收购Hugging Face,黄仁勋表示平台将保持独立开放,不强制用英伟达算力,坚持开放权重生态。英伟达会提供基建支持,保留其品牌,助其发展。

AI寒武纪
新闻资讯8

苹果放王炸!开放大模型访问权、全家桶集成ChatGPT,人人能开发AI应用

苹果在“WWDC 2025”大会宣布在多设备集成Apple Intelligence功能,含ChatGPT图像生成等。开放基础模型访问权,开发者可开发适配应用。新功能将逐步开启测试,今年秋季部分用户可用。

AIGC开放社区
产品应用7

Manus突发上新文生图!告别“抽卡”,Agent+深度思考联合创作

Manus深夜官宣支持生成图像,与一般AI绘图工具不同,它能理解画图目的,规划方案后再生成。它可完成如房间装修可视化、饮料瓶设计等任务。目前已开放注册,不过付费价格遭网友吐槽。

量子位
开源动态8

NeurIPS 25开新坑:145万个图文对,覆盖八种主流水下理解任务

华中科技大学团队推出首个水下多模态大模型NAUTILUS,支持8种水下场景理解任务,还开源145万图文对的NautData数据集。模型通过VFE模块解决水下图像问题,性能超越现有模型,恶劣环境表现更佳。

新智元
算法论文8

1/15成本,实现AI水印新SOTA | 南洋理工大学&A*STAR

给AI生成作品打水印成行业共识,但传统方法有短板。南洋理工大学等机构研究人员提出局部鲁棒图像水印方法MaskMark,成本仅为Meta模型WAM的1/15,在多任务中表现优异。

量子位
算法论文7

从OpenAI AI Phone到Gemini on Android:AI手机时代需要怎样的Agent Harness?

过去一年,AI与手机关系被重新定义,腾讯元等机构研究PhoneHarness,关注AI在手机上行动及任务完成验证问题。它让手机Agent行动不止GUI,还有Bench检验执行结果,推进AI手机基础设施建设。

机器之心
新闻资讯8

Andrej Karpathy 分享ChatGPT模型选择指南

前OpenAI创始成员Andrej Karpathy发文分享ChatGPT模型使用指南,点出关键事实,如o3适合重要任务。社区热烈讨论,专业用户分享策略,还对o4 - mini等模型表现给出反馈。

AGI Hunt
新闻资讯7

OpenAI,关门!

2025年11月,Google发布的Gemini 3碾压GPT - 5.1,奥特曼承认落后。同时,反AI组织Stop AI联合创始人Sam Kirchner精神失常,袭击成员并威胁伤害OpenAI员工,致OpenAI总部关门戒备。

新智元