「图像定制化」共找到 1345 篇相关文章
横扫海外的阿里大模型,有自己的APP了,叫“千问”
11月17日,阿里巴巴上线“千问App”,将Qwen系列模型装进面向C端用户的独立App。它设计极简,功能强大,免费使用。主模型为Qwen3,问答结构化,多模态交互方便,还有翻译等特色功能,背后是强大的Qwen模型生态。
爆火的AI三宫格图片,比我们的生活更像电影。
最近三宫格AI图片爆火,起初是唯美电影感写真配文艺台词,后各地文旅、宠物赛道等画风渐趋抽象。其制作简单,用豆包的Seedream 4.0即可,文中还给出Prompt模板,该现象内核是将生活电影化。
社区供稿 | Jina Embeddings V4: 为搜索而生,多模态多语言向量模型
Jina AI发布多模态向量模型jina-embeddings-v4,参数38亿,能同步处理文本与图像。内置LoRA适配器强化检索等任务表现,在多基准测试中展现顶尖性能,支持单/多向量表示。介绍了架构、上手指南等。
十万美元的机械狗,正在“排泄”你的肖像!
迈阿密巴塞尔艺术展上,单价十万美元的《普通动物》作品由三只戴扎克伯格、马斯克和安迪·沃霍尔面具的机械狗组成,内置摄像头,能捕捉画面经AI生成图像后“排泄”出实体作品,迅速售罄,引发不同看法。
3年7倍!揭秘博通的崛起与铁腕CEO陈福阳
科技媒体The Information讲述博通与CEO陈福阳的故事。陈福阳以铁腕管理和精准并购让博通市值达万亿美元,股价三年涨近七倍。其定制芯片业务有重要客户,但也面临AI支出、竞争等风险。
字节跳动Seed推出「机器人大脑」Robix:让机器人学会思考、规划与灵活互动
近日,字节跳动Seed团队发布「机器人大脑」Robix,它将推理、任务规划与人机交互整合到单个端到端多模态模型。通过层次化架构分工,它能灵活互动,经三阶段训练,在多方面表现出色,为具身智能体发展奠基。
智能体时代,人类与AI如何分工?
本文围绕智能体时代人类与AI的分工展开,探讨工作模式、技能需求等变化。指出智能体使工作时空重构、原子化,挑战传统职业身份,还使工作与生活边界模糊,同时强调人类需掌握系统思维等元技能与智能体协作。
看完Kimi K2.5技术报告,它的视觉Agentic真给我惊到了
Moonshot AI发布Kimi K2.5技术报告,该模型将文本和视觉打通,有并行执行的智能体集群系统。它采用Joint Training,提出“Zero-Vision SFT”,用MoonViT - 3D处理图像和视频,开源后受欢迎,展示通用智能体可能。
你以为在点「红绿灯」验证身份,其实是在给AI免费打工
验证码发展多年,从最初文本形式到如今图像形式。用户点选验证码时,实际在为AI免费提供训练数据,如谷歌让全球网民免费转录资料、为自动驾驶AI打工。如今验证码攻防战激烈,未来或利用AI弱点创新。
2026年了,我们还在用爱迪生试灯丝的方式评估World Model
文章围绕World model展开深度讨论,界定其概念,分析生成派、JEPA派、空间智能派三条技术路线,指出评估比LLM难,提及游戏化benchmark可能是破局点,还强调具身进展由数据驱动,Ego - View或为泛化关键。