图像定制化」共找到 1345 篇相关文章

产品应用8

横扫海外的阿里大模型,有自己的APP了,叫“千问”

11月17日,阿里巴巴上线“千问App”,将Qwen系列模型装进面向C端用户的独立App。它设计极简,功能强大,免费使用。主模型为Qwen3,问答结构,多模态交互方便,还有翻译等特色功能,背后是强大的Qwen模型生态。

MacTalk
新闻资讯7

爆火的AI三宫格图片,比我们的生活更像电影。

最近三宫格AI图片爆火,起初是唯美电影感写真配文艺台词,后各地文旅、宠物赛道等画风渐趋抽象。其制作简单,用豆包的Seedream 4.0即可,文中还给出Prompt模板,该现象内核是将生活电影

数字生命卡兹克
开源动态8

社区供稿 | Jina Embeddings V4: 为搜索而生,多模态多语言向量模型

Jina AI发布多模态向量模型jina-embeddings-v4,参数38亿,能同步处理文本与图像。内置LoRA适配器强检索等任务表现,在多基准测试中展现顶尖性能,支持单/多向量表示。介绍了架构、上手指南等。

Hugging Face
新闻资讯7

十万美元的机械狗,正在“排泄”你的肖像!

迈阿密巴塞尔艺术展上,单价十万美元的《普通动物》作品由三只戴扎克伯格、马斯克和安迪·沃霍尔面具的机械狗组成,内置摄像头,能捕捉画面经AI生成图像后“排泄”出实体作品,迅速售罄,引发不同看法。

搜狐看展
新闻资讯7

3年7倍!揭秘博通的崛起与铁腕CEO陈福阳

科技媒体The Information讲述博通与CEO陈福阳的故事。陈福阳以铁腕管理和精准并购让博通市值达万亿美元,股价三年涨近七倍。其定制芯片业务有重要客户,但也面临AI支出、竞争等风险。

芯师爷
产品应用8

字节跳动Seed推出「机器人大脑」Robix:让机器人学会思考、规划与灵活互动

近日,字节跳动Seed团队发布「机器人大脑」Robix,它将推理、任务规划与人机交互整合到单个端到端多模态模型。通过层次架构分工,它能灵活互动,经三阶段训练,在多方面表现出色,为具身智能体发展奠基。

机器之心
推荐文章8

智能体时代,人类与AI如何分工?

本文围绕智能体时代人类与AI的分工展开,探讨工作模式、技能需求等变。指出智能体使工作时空重构、原子,挑战传统职业身份,还使工作与生活边界模糊,同时强调人类需掌握系统思维等元技能与智能体协作。

AI科技大本营
开源动态8

看完Kimi K2.5技术报告,它的视觉Agentic真给我惊到了

Moonshot AI发布Kimi K2.5技术报告,该模型将文本和视觉打通,有并行执行的智能体集群系统。它采用Joint Training,提出“Zero-Vision SFT”,用MoonViT - 3D处理图像和视频,开源后受欢迎,展示通用智能体可能。

PaperAgent
新闻资讯7

你以为在点「红绿灯」验证身份,其实是在给AI免费打工

验证码发展多年,从最初文本形式到如今图像形式。用户点选验证码时,实际在为AI免费提供训练数据,如谷歌让全球网民免费转录资料、为自动驾驶AI打工。如今验证码攻防战激烈,未来或利用AI弱点创新。

机器之心
推荐文章7

2026年了,我们还在用爱迪生试灯丝的方式评估World Model

文章围绕World model展开深度讨论,界定其概念,分析生成派、JEPA派、空间智能派三条技术路线,指出评估比LLM难,提及游戏benchmark可能是破局点,还强调具身进展由数据驱动,Ego - View或为泛关键。

五源资本 5Y Capital