AI视觉内容生成」共找到 10223 篇相关文章

新闻资讯8

原神LOL齐聚的Unity开发者大会,我看到了AI游戏的未来

2025 Unity开发者大会展示了“AI+游戏”的新趋势。Unity团结引擎推出AIGC工作流平台AI Graph,降低开发门槛;AWS用AI赋能游戏全生命周期;Meshy专注3D GenAI。但玩家对AI创作有抵触,需建立信任机制。

量子位
7

盘点丨百度那些悄咪咪下线的 AI 产品

AI时代个人创新创业相对简单,AI产品更新迭代快。作者盘点百度下线AI产品,如心响、梯子AI等,分析下线原因,指出大厂做C端AI创新面临结构性矛盾,还提到成功转型的百度文库。

特工宇宙
开源动态7

最大游戏up主也玩本地AI?让笔记本都能跑大模型的Parallax来了

11月3日,知名游戏博主PewDiePie展示自建本地AI系统,引发全网轰动。本地AI有隐私、性能等优势。Parallax是开源AI项目,挑战“AI必须上云”逻辑,支持异构设备组网和多模型,性能优。

机器之心
推荐文章7

AI 创业角度看 GEO:如何引流、效果评估,以及创业机会在哪里?

文章从AI创业角度剖析GEO,介绍其原理、内容优化策略、实操建议、效果评估搭建、代表产品等,指出GEO与SEO不同,虽有争议但值得做,还探讨了相比SEO的更多想象空间。

Founder Park
算法论文8

上海交大DENG Lab提出「LatentUM」:Unified Model的真正「战场」在视觉推理与世界模型

上海交通大学 DENG Lab 提出的 LatentUM,尝试让统一模型把生成的视觉内容纳入推理闭环。它在多项任务上超越基线,其核心思路是生成与语言共享语义空间的离散 visual semantic tokens,模型含三大关键设计。

机器之心
算法论文8

国产多模态Agent拿下医学分割SOTA!不用改模型、不加token | 浙大&上海AI Lab

现有医学多模态大模型在分割生物医学图像时存在瓶颈,浙大蔡钰祥教授、上海AI Lab江彦开等人提出IBISAgent框架,将分割定义为多步视觉决策过程,实验显示其在多数据集上大幅领先对比方法。

量子位
新闻资讯7

20%的美国打工人把活儿甩给AI!被替代的是任务,不是岗位

8月6日,Epoch AI联合Ipsos发布职场调查报告,20%美国就业者将工作甩给AI,表明活儿在人和AI间重新分配。AI参与广但不深入,用时情况不一,输出多需修改,先冲击外包工作,且使用不均衡。

新智元
新闻资讯8

Bengio 15 年前论文再夺 AAAI 奖!AI 正告别单纯炫技,走向真实世界

全球人工智能顶会AAAI揭晓年度奖项,Yoshua Bengio 2011年论文获经典论文奖。今年5篇杰出论文研究方向指向AI从炫技走向应用,如ReconVLA改进VLA视觉感知,CADYT解决连续时间因果结构学习空白等。

InfoQ
开源动态7

比NotebookLM更好的「开源播客」,可根据多模态内容生成30分钟以上播客音频。

Podcastfy是开源Python工具,能把文本、图片等多模态内容,借生成式AI转化为播客。它支持自定义,适配多种语言和文本转语音模型,能生成2 - 5分钟或30分钟以上的播客,使用体验比NotebookLM好。

开源AI项目落地
开源动态8

告别评估乱象!首个视觉解释综合性基准发布,附人类真值 | KDD'25

埃默里大学团队推出首个视觉解释基准Saliency - Bench,构建8个任务的数据集,提供标准化评估流程与开源工具包,解决评估缺乏标准等问题,推动可解释AI向可靠、透明发展。

新智元