「在线设计服务」共找到 1994 篇相关文章
我做了个 Skill:让 AI 帮你生成 Logo 和图标
作者因用 Gemini 为 CodePilot 生成 Logo 获关注,开发了 Logo Generator Skill。该 Skill 可三步生成 Logo 与高级展示图,还介绍了不直接用 AI 画 Logo 的原因、使用场景、开源地址与安装方式。
Claude Code 能写十万行代码,读一篇公众号就废了
Claude Code 读链接能力弱,qiaomu - markdown - proxy 这个 Claude Code Skill 可解决。它按 URL 类型走不同通道抓内容转 Markdown,全程免费,安装简单,解决了 Claude Code 系统性短板。
打破视频推理「先看后想」惯性,实现真正的「边看边想」丨CVPR'26
现有大型视觉语言模型(VLM)在实时场景表现不佳,宁波东方理工大学沈晓宇团队提出TaYS,让VLM从“帧文交错”切换到“并行”,实现“边看边想”,在准确性和延迟上表现出色,推动VLM走向更真实应用。
中东芯片王国与孤勇者:以色列和伊朗境内半导体企业一览
在地缘政治冲突下,中东地区晶圆代工厂供货受影响,中国台湾部分企业订单回升。文章梳理了以色列和伊朗半导体企业格局、能力与生态,以色列产业发达,多被巨头收购;伊朗产业落后,聚焦成熟制程。
Gemini AI /Nano Banana Pro图像无损去水印工具
这是基于Javascript的纯浏览器端Gemini AI图像无损去水印工具,用反向Alpha混合算法,有纯浏览器端处理、隐私保护等特性,介绍使用方法、算法原理等。
图像分层生成:新加坡国立大学和Lowart AI实现了图像可编辑的PSD文件输出
新加坡国立大学和Lowart AI发布OmniPSD,利用Diffusion Transformer架构解决分层图像生成与拆解难题,实现可编辑PSD文件输出。它能通过文本生成分层PSD文件,也能拆解单张平面图像,解决AI生成图像难编辑痛点。
OpenAI的新浏览器实测被吐槽疯了?走“乔布斯风”、挖谷歌骨干,奥特曼就“复制”出个ChatGPT版Chrome?
OpenAI发布全新网页浏览器ChatGPT Atlas,其将ChatGPT置于网页体验核心,有常驻侧边栏助手等功能。虽冲击谷歌,但用户实测反馈不一,且此类智能代理浏览器存在新安全风险。
在上海!邀你踏入“未来分身术”的沉浸世界
2025年9月26日14:00,MANA在上海the point空间邀你体验“未来分身术”。艺术家赵博雄会带来“分身术”艺术实验,还介绍了数字艺术分身术在公共文化、演出等方面的价值及活动流程和参与方式。
使用最新的 Claude 4,我用两天就开发出一个视频编辑器,但却无法维护
作者用Claude 4两天开发出视频编辑器,却难维护。分析原因,指出AI编程在模块级强,但系统层面不足,还列举网友讨论,探讨AI在软件工程各方面的能力及局限。
谢赛宁等推出统一多模态模型!替代VAE实现图像理解/生成双SOTA,代码权重数据集全开源
谢赛宁等团队推出统一多模态模型Blip3 - o,用扩散Transformer生成CLIP图像特征,采用顺序预训练策略。对比多种设计方案,确定CLIP + Flow Matching最佳,模型在多任务测试表现卓越且全开源。