AI图像水印」共找到 9966 篇相关文章

产品应用7

蚂蚁多模态统一框架Ming-Omni:能看懂世界、会说话、还能画画

文章介绍蚂蚁多模态统一框架Ming - Omni,它可统一处理图像、文本等多模态数据。该框架解决了多模态训练中模态表示差异、收敛速度不一致等问题,采用分阶段预训练,能用于图像、音频生成及多模态交互。

CourseAI
新闻资讯7

210亿美元的幻觉?奥特曼投了一家核能初创

AI热潮下,Oklo核能初创靠概念市值达210亿美元,投资人是奥特曼;而从SpaceX离职的工程师创立Quilter,让AI画电路板,几分钟完成工程师三天工作,二者代表造梦与造物两种姿态。

新智元
新闻资讯8

硅谷刷屏的ClawdBot,让Mac mini卖爆了!创始人爆料:一人开发、100% AI 写代码,全开源却留 0.00001% 给全网来 hack

个人 AI 助手 ClawdBot 席卷硅谷,网友评价高,项目已开源获 20.8k stars。它几乎 100% 用 AI 写代码,协作方式激进,创始人还留 0.00001% 作为“安全靶子”。其功能强大但有安全隐患,还带火了 Mac Mini。

InfoQ
产品应用7

央企怎么做超级智能体?对谈中电信天翼AI:自研模型为底座,自主规划是必须,能适应千行百业才行

中国电信天翼AI发布星辰超级智能体,获2025企业级AI Agent榜单央企第一。它依托自研“星辰大模型”,具备全模态、复杂推理等能力。访谈专家指出智能体可直接产出应用,落地需嵌入主业系统,电信持续迭代模型优化它。

量子位
产品应用8

「香蕉革命」首揭秘!谷歌疯狂工程师死磕文字渲染,竟意外炼出最强模型

谷歌最新图像模型nano banana横空出世,能融合图片、理解地理等结构,实现多轮创作。它凭借Gemini知识与交错生成技术,重塑AI图像生成边界。谷歌团队揭秘其技术,还谈及未来发展方向。

新智元
产品应用7

一块画板,Nano Banana,无限创意:谷歌新工具实测

谷歌Labs推出AI概念板Mixboard,由Nano Banana图像模型驱动,整合Gemini 2.5 Flash模型。可上传个人图像混合编辑,适合设计师等。现仅在美国公开测试,速度快,操作便捷,能高效验证想法。

AI进修生
新闻资讯8

从兼职工程师直接跳到CTO,他用两个月让一款 Agent 干掉60%复杂工作并放话:“代码质量与产品成功没有直接关系”!

金融科技公司 Block 的 CTO Dhanji R. Prasanna 分享公司 AI 转型经验。Block 在 8 周内部署 AI 智能体,推出开源 AI Agent 框架 Goose,能节省员工工时,还谈到组织变革、AI 应用及招聘等多方面见解。

AI前线
产品应用7

这样更公平:用jina-reranker-m0为多模态文档打分重排

文章指出多模态搜索领域给文档综合评分难,因文本与图像评分缺乏可比性。2025年4月发布的jina - reranker - m0可解决此问题,其两阶段检索流程能显著提升召回率,对多模态AI系统设计有启发。

Jina AI
开源动态8

o3绞尽脑汁仅答对40%的题目,开源模型基本乱猜?MMSI-Bench:多图空间智能试金石

文章介绍了MMSI - Bench,这是用于评估MLLM多图像空间推理能力的VQA基准。它人工构建样本、全面分类任务、采用多样真实数据。实验显示MLLM在多图像空间推理有短板,还开发自动化错误分析流程助力改进。

量子位
开源动态8

重磅开源!240亿参数力压Nano Banana 2

4月初,京东探索研究院开源JoyAI - Image - Edit图像模型。它是业内首个将「空间智能」写进底层的开源一体化图像模型,能让模型「理解空间,编辑空间」,在电商和具身智能场景极具价值。

新智元