图像推测」共找到 483 篇相关文章

新闻资讯8

苹果放王炸!开放大模型访问权、全家桶集成ChatGPT,人人能开发AI应用

苹果在“WWDC 2025”大会宣布在多设备集成Apple Intelligence功能,含ChatGPT图像生成等。开放基础模型访问权,开发者可开发适配应用。新功能将逐步开启测试,今年秋季部分用户可用。

AIGC开放社区
产品应用7

Manus突发上新文生图!告别“抽卡”,Agent+深度思考联合创作

Manus深夜官宣支持生成图像,与一般AI绘图工具不同,它能理解画图目的,规划方案后再生成。它可完成如房间装修可视化、饮料瓶设计等任务。目前已开放注册,不过付费价格遭网友吐槽。

量子位
开源动态8

NeurIPS 25开新坑:145万个图文对,覆盖八种主流水下理解任务

华中科技大学团队推出首个水下多模态大模型NAUTILUS,支持8种水下场景理解任务,还开源145万图文对的NautData数据集。模型通过VFE模块解决水下图像问题,性能超越现有模型,恶劣环境表现更佳。

新智元
算法论文8

1/15成本,实现AI水印新SOTA | 南洋理工大学&A*STAR

给AI生成作品打水印成行业共识,但传统方法有短板。南洋理工大学等机构研究人员提出局部鲁棒图像水印方法MaskMark,成本仅为Meta模型WAM的1/15,在多任务中表现优异。

量子位
新闻资讯7

华纳兄弟起诉Midjourney

Theverge消息,华纳兄弟起诉文生图平台Midjourney,称其AI工具生成大量侵犯版权的角色图像和视频,如蝙蝠侠、超人等。诉状列举侵权行为,提供对比案例,华纳希望获禁令并索赔。

AIGC开放社区
新闻资讯7

Grok 4 突然自称希特勒,遭Anthropic 研究员指责不守规矩、不顾安全

Grok 4 Heavy被发现回答姓氏为「希特勒」,普通版Grok 4正常。研究员推测其受过去错误影响,对发布前测试构成挑战。Anthropic研究员批评xAI发布Grok 4无安全测试文档,引发行业争论。

AGI Hunt
新闻资讯7

ChatGPT爱用破折号是病,奥特曼刚宣布已经治好了

奥特曼官宣ChatGPT重要更新,可听从指示不再滥用破折号。此前ChatGPT爱用破折号,成AI生成内容标志,引发用户吐槽。GitHub工程师研究推测,19世纪出版物引入或是AI偏爱破折号主因。

量子位
新闻资讯8

OpenAI放大招!核心API支持MCP,一夜改变智能体开发

今天凌晨,OpenAI全资收购io消息吸睛,还悄悄宣布核心API——Responses API支持MCP服务。这简化智能体开发,还能集中管理工具、保障安全。此外,Responses API的图像生成等工具也有更新,并引入新功能。

AIGC开放社区
开源动态8

微软炸场了!一张图片仅需3即可生成带完整PBR材质的超高质量3D资产!

微软推出3D资产生成大模型TRELLIS,能接收文本或图像提示,输出高质量3D资产。其结果质量强,支持灵活切换输出格式和局部3D编辑,还给出安装和使用方法及项目地址。

GitHubStore
开源动态8

不改模型、不降质量,谷歌让Gemma 4快了3倍:本地跑大模型彻底变天

谷歌给Gemma 4家族更新Multi - Token Prediction推测解码架构,推理速度最高提升3倍且输出质量不变。介绍了LLM推理慢的原因、MTP解决办法、对开发者的利好、技术细节、使用方式等。

AI寒武纪