多风格图像」共找到 4511 篇相关文章

新闻资讯7

基金委鼓励AI与力学各个方向的交叉和融合

基金委鼓励AI与力学各方向交叉融合。力学含分支学科,在各领域研究中,既支持基础前沿研究,推动与新兴领域交叉,又重视与重大需求融合,还鼓励利用现有条件研发软件和仪器。

力学与人工智能
推荐文章7

Skills火爆之后,我收集并整理了最近全网火爆的Skills,拿走不谢~~~

文章介绍 Agent Skills,称其是 AI 助理的「使用指南」,技能分浏览、加载、使用三阶段加载,有快且轻、跨平台、易分享等优势。还推荐个优秀 skills 及相关工具网站,提醒从业务出发看待它。

小华同学ai
新闻资讯7

年入103万美元!AI 独立开发者天花板!普通人应如何实践?

2026年初,法国独立开发者Marc Lou晒出2025年103万美元收入,他靠一人开发产品,利用AI工具快速迭代。他采用产品矩阵、交叉推广等策略,也分析了中国独立开发者状况,给出入局建议。

鲸选AI
开源动态7

Karpathy组建大模型「议会」,GPT-5.1、Gemini 3 Pro等化身最强智囊团

前OpenAI联合创始人Andrej Karpathy发推称养成用LLM阅读习惯,还做了个新项目,让四个最新大模型组成LLM议会当智囊团。项目是Web应用,提问后模型处理,有互评和投票机制,已开源。

机器之心
开源动态8

3B Image Captioning小钢炮重磅来袭,性能比肩Qwen2.5-VL-72B

文章推荐Dense Image Captioning新技术CapRL,它首次将DeepSeek - R1强化学习法用于image captioning,创新定义reward。训练的CapRL - 3B模型性能比肩Qwen2.5 - VL - 72B,解决了reward设计难题,已开源相关内容。

机器之心
算法论文8

Being-VL的视觉BPE路线:把「看」和「说」真正统一起来

北大、UC San Diego 和 BeingBeyond 联合提出 Being-VL 的视觉 BPE 路线,先将图像离散化并「分词」,再与文本统一建模,能缩短跨模态链路、保留视觉结构先验,还介绍了实现步骤、训练方式等。

机器之心
新闻资讯7

LeCun今后发论文得亚历山大王批准!Meta搞出大无语操作

量子位独家获悉,Meta宣布FAIR对外发表论文须经TBD审核。TBD由首席AI官Alexandr Wang执掌,与FAIR是平行关系。此规定引发FAIR内部不满,有人跳槽,Alexandr Wang行事风格饱受争议。

量子位
开源动态8

腾讯开源WMT2025冠军大模型:拿下30个第一,同类最佳

昨晚腾讯开源WMT2025冠军翻译大模型Hunyuan - MT - 7B,它在31种语言测试中获30个第一,成同类最佳。文中介绍其架构、训练过程,还通过场景翻译案例展现优势,有望推动高质量翻译普及。

AIGC开放社区
开源动态7

Oxlint 1.0 稳定版发布:基于 Rust 的 JavaScript 静态检查器

Oxlint是基于Rust的JavaScript和TypeScript静态检查器,其1.0稳定版发布。它有快速检测、规则覆盖广等特点,性能比ESLint高50 - 100倍,能处理文件规则,开发者反馈积极。

InfoQ
推荐文章7

当人们误解了AI的本质,会发生什么?

文章指出尽管科技公司CEO宣称AI强大,但大语言模型无人类智慧。人们误解AI本质危害,如将其当精神导师、用AI替代人际互动等,还揭露产业背后廉价劳工,强调要认清AI本质。

宝玉AI