图像风格化」共找到 1326 篇相关文章

新闻资讯7

Claude年收入首次反超OpenAI

最新数据显示,Claude背后的Anthropic年营收突破300亿美元,首超OpenAI。其大部分收入来自API,企业客户增长迅猛。还与谷歌、博通签数GW级TPU算力协议,2027年供货。

量子位
算法论文8

BookRAG:专治各种「层次复杂」文档

BookRAG专为处理层次复杂文档而生。传统RAG有两大盲区,而BookRAG在多模态长文档基准上刷新SOTA。它采用BookIndex×Agent - based Retrieval技术方案,效率高、可扩展性强,兼顾高精度、高召回、低成本。

PaperAgent
推荐文章8

Fluss 湖流一体:Lakehouse 架构实时演进

湖仓一体 Lakehouse 成主流架构,但数据时效性最多达分钟级。阿里云罗宇侠在 QCon 大会分享 Fluss 湖流一体方案,解析技术架构与原理,介绍融合趋势、核心优势、使用方法及未来规划。

InfoQ
算法论文8

AdaGen: 让图像生成模型学会自适应策略

当前主流图像生成模型多步策略依赖手工静态调度规则,存在需大量调参、无法适配样本特性的问题。本文提出AdaGen框架,通过强学习训练策略网络,在四大生成范式上实现性能提升与效率优

机器之心
产品应用8

字节Lynx:从单张图像生成高保真个性视频

字节推出高保真个性视频生成框架Lynx,基于开源的Diffusion Transformer,引入ID - adapter和Ref - adapter,在基准数据集表现优异,能平衡身份保真度等,还可拓展至多模态和多主体。

带你学AI
算法论文8

nnU-Net:医学图像分割的自适应自动框架

德国癌症研究中心团队提出 nnU-Net 自配置医学图像分割框架,能根据数据集特征自动推导预处理、网络拓扑等策略获稳健分割基线。文章介绍其原理、优缺点、评测案例及 Python 代码实现。

机器学习AI算法工程
新闻资讯7

余家辉交卷!Meta MSL连发图像/视频模型

Meta MSL由余家辉带队发布图像模型Muse Image,开启视频模型Muse Video预览。Muse Image表现出色,采用独特创作流程,能与Muse Spark联动,有多种实用功能;Muse Video待改进,将未来几月推出。

量子位
产品应用8

松下发布多模态大模型,文本、图像、音频随意切换

多模态数据处理成热点,但现有模型处理复杂任务有挑战。松下开发多模态大模型OmniFlow,采用模块设计、多模态引导机制,实验显示其在多任务中有卓越表现。

AIGC开放社区
新闻资讯7

ChatGPT后遗症来了!人类日常聊天越来越AI

佛罗里达州立大学团队花两年分析ChatGPT发布前后非脚本口语录音,在2210万个词的数据集中发现学术写作词高频出现在日常说话中,人类聊天用词渐向AI靠拢,但研究也存在局限性。

量子位
开源动态8

10 分钟 CLI 任何网站,AI全网一键调用!

AI Agent上网难,传统爬虫易遇反爬问题。开源项目`bb-browser`通过模拟真实浏览器登录态操作,支持36个平台、103个命令,能绕过反爬,还可在浏览器内运行JS等,在GitHub获4.5k+ star。

开源先锋