「图像自动着色模型」共找到 1015 篇相关文章
Google DeepMind CEO Hassabis 最新访谈:未来十年实现完整 AGI,引领科学黄金时代
Google DeepMind CEO Demis Hassabis在访谈中分享诸多观点。他认为未来十年能实现完整AGI,还谈到Genie 3重新定义视频、人形机器人重要性等,指出AI创造力不足等局限,也提及旗下公司在制药等领域突破。
「CV 铁三角」落定Meta,视觉 AI 如何向多模态演进?
Meta 高薪挖来「CV 铁三角」引关注,其研究成果与视觉 AI 向多模态演进路径高度贴合。他们过往十年协作,研究涵盖 S4L、BiT、ViT 等,构建起现代多模态 AI 基础框架。
炸裂,Directus要干掉后台团队!GitHub 31K+星神器:SQL秒变API,你只管设计界面!
Directus是开源开放数据平台,能将SQL数据库升级为有REST+GraphQL API的实时数据后端,提供无代码数据管理界面。它功能亮点多,技术架构优,适用于多种场景,与同类项目相比有独特优势。
Google新研究:降低大模型幻觉的全新视角——充分上下文!
谷歌新研究《SUFFICIENT CONTEXT: A NEW LENS ON RETRIEVAL AUGMENTED GENERATION SYSTEMS》提出“充分上下文”概念,剖析RAG系统失败原因并给出解决方案,对提升企业AI准确性和可靠性有重要意义。
何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升
何恺明最新论文研究扩散模型与表征学习的联系,提出Dispersive Loss正则化方法。它无需正样本对,有高通用性、低计算开销等优势,在多模型测试中提升了生成质量,在其他任务也有潜力。
医学领域也有世界模型了:精准模拟肿瘤演化,还能规划治疗方案
来自多机构学者联合提出医学世界模型(MeWM),赋予AI“预演”疾病发展的能力。它能模拟肿瘤演化,为个性化治疗提供辅助,有肿瘤演变模拟、生存风险预知和临床决策闭环三大核心功能。
字节开源了一个了不得的模型!
字节跳动开源统一多模态基础模型BAGEL,一个模型能同时理解和生成文本、图像、视频。部署测试有亮点但效果不稳定,还分享该模型体验Demo、地址及安装使用教程。
AI实力榜大洗牌!OpenAI谷歌强势领跑,Anthropic节节败退
Poe最新报告显示,2025年1 - 5月AI各领域市场份额大洗牌。OpenAI和谷歌势头猛,Anthropic掉队。文本生成、推理、图像等各领域竞争激烈,企业需搭建评估体系,按需选模型。
这个开源项目 OpenStory,把 AI 短剧制作变成了一条可复制的工业流水线!
现在制作完整AI短剧流程繁琐,很多团队是小作坊式生产,效率低且难规模化。OpenStory开源项目站在成熟AI服务肩上,将AI短剧制作工业化,能把剧本变成风格统一的视频作品,解决诸多痛点。
Claude Code 推出安全审计插件,边写代码边抓漏洞
Claude Code上线官方安全插件security - guidance,能在写代码时自动识别并修复安全漏洞。它分三层防线,覆盖多种漏洞类型,还支持自定义安全策略,安装方便,但只是辅助工具。