图像自动着色模型」共找到 1015 篇相关文章

算法论文8

罕见!Meta、OpenAI、xAI联合分享了用生产环境提升LLM的最佳实践!

Meta、OpenAI、xAI联合发表成果CharacterFlywheel,聚焦在生产环境提升社交型AI对话能力。团队基于LLaMA 3.1迭代15个版本,7/8的A/B测试显示正向提升,介绍了架构、数据管道、奖励模型等内容。

PaperAgent
产品应用8

追更太累,桌面版AI帮我把 OpenClaw 的剧情补齐了

作者因OpenClaw信息爆炸跟不过来,想到让AI帮忙。介绍了AI播客自动化案例及Cowork短板,引出天工Skywork桌面版。用其处理视频、监控AI社区,还构建安全屏障,该工具打通内容创作和信息监控闭环。

AGI Hunt
产品应用8

Gemini 3 Pro的位置,Kimi K2.5也想坐坐?

Kimi 发布 K2.5,在视觉编程上表现亮眼。它通过多模态训练涌现审美,能生成美观网页。与 Gemini 3.0 对比各有优势,Kimi Code 开源终端 Agent 功能强大,Kimi 还探索 Agent Swarm 协作新路径。

AGI Hunt
开源动态7

推出 AnyLanguageModel:在 Apple 平台统一本地与远程大语言模型的 API

大语言模型是构建现代软件的重要工具,但 Apple 平台开发者集成模型困难。Hugging Face 发布 AnyLanguageModel,是 Swift 包,可替代 Apple Foundation Models 框架,支持多模型服务商,降低使用 LLM 难度。

Hugging Face
开源动态8

这届网友太狠了:Clawdbot爆火,狂囤40台Mac mini来跑

周末,AI 助手 Clawdbot 爆火,顺带带火了 Mac mini。它可在聊天软件中对话、自动完成任务,由四大核心组件支撑,应用场景广泛,创始人 Peter Steinberger 于 2026 年 1 月发布该开源项目。

机器之心
开源动态7

爆火全网FLUX.2重磅上线,开源版Nano Banana来了!

Black Forest Labs的开源视觉模型FLUX.2上新,是专为现实创意工作流程打造的生产力工具。与前代相比,实现从「会画」到「懂你要画什么」跃升,还能在多方面保持一致性,各变体有不同定位与场景。

新智元
产品应用8

太炸裂了!全网实测Nano Banana Pro,网友:这模型里到底装了什么鬼东西!

谷歌Nano Banana Pro出世引发全网关注,它又名Gemini 3 Pro Image,整合多模态理解能力与知识库。普通用户可在Gemini应用免费体验,实测显示其实力强悍,还在网友手中玩出花,谷歌CEO也站台。

量子位
产品应用8

Nano Banana Pro上线!集成Gemini 3与Veo 3,谷歌不给竞争对手喘息机会

谷歌推出最强文生图模型Nano Banana Pro,又名Gemini 3 Pro Image,整合Gemini 3 Pro多模态理解能力与谷歌搜索知识库。它提升文字渲染等能力,支持多种分辨率和格式,还集成视频生成模型,覆盖多类用户。

量子位
开源动态8

Kimi K2 Thinking突袭!智能体&推理能力超GPT-5,网友:再次缩小开源闭源差距

Kimi K2 Thinking发布并开源,主打“模型即Agent”,能边思考边用工具,连续工具调用200 - 300次。在多评测基准超GPT - 5等闭源模型,代码权重遵循MIT协议,可在官网和应用实测。

量子位
开源动态8

NVIDIA开源“Banana”级黑科技!会懂物理、理解时间的图像编辑模型!

继谷歌Banana后,英伟达开源物理级图像编辑模型ChronoEdit - 14B,被称‘NVIDIA版的Banana’。它有‘时间观念’和‘物理常识’,能按描述生成符合物理规律图像,适用于多领域。

开源星探