「文本到图像生成」共找到 2675 篇相关文章
ChatGPT也上线了个人年度报告!
OpenAI 让 ChatGPT 上线「Your Year with ChatGPT」功能,根据用户过去一年对话生成专属年度回顾。报告有数据统计、聊天风格分析、年度奖项等,还能预测 2026 年,虽简洁但数据更私密真实。
近500页史上最全扩散模型修炼宝典,宋飏等人一书覆盖三大主流视角
宋飏等人所著《The Principles of Diffusion Models》共460多页,系统梳理扩散模型发展脉络与核心思想,以统一数学框架串联多种视角,是研究者参考资料与初学者入门读物。
OpenAI 首款AI浏览器发布 —— ChatGPT Atlas |附实测
OpenAI发布首款AI原生浏览器ChatGPT Atlas,自带记忆和Agent能力,有chatgpt侧边栏、光标一选就改写等功能,目前仅发布macOS版,后续将推多版本,Agent模式付费且为预览版。
Google DeepMind CEO Hassabis 最新访谈:未来十年实现完整 AGI,引领科学黄金时代
Google DeepMind CEO Demis Hassabis在访谈中分享诸多观点。他认为未来十年能实现完整AGI,还谈到Genie 3重新定义视频、人形机器人重要性等,指出AI创造力不足等局限,也提及旗下公司在制药等领域突破。
首个基于 MCP 架构的低代码 RAG 框架
检索增强生成系统复杂度提升,科研人员面临高昂工程成本。清华大学等联合推出 UltraRAG 2.0,基于 MCP 架构,降低复杂 RAG 系统技术门槛与学习成本,支持低代码构建复杂系统。
加一个字母就可以绕过AI围栏,新的漏洞:TokenBreak
提示词注入攻击威胁大模型及应用,当前主要防护方法是用BERT模型检测。HiddenLayer团队发现TokenBreak漏洞,通过加字母绕过检测。研究表明BPE和WordPiece分词策略易受攻击,Unigram不易,建议优先选Unigram类模型。
「CV 铁三角」落定Meta,视觉 AI 如何向多模态演进?
Meta 高薪挖来「CV 铁三角」引关注,其研究成果与视觉 AI 向多模态演进路径高度贴合。他们过往十年协作,研究涵盖 S4L、BiT、ViT 等,构建起现代多模态 AI 基础框架。
炸裂,Directus要干掉后台团队!GitHub 31K+星神器:SQL秒变API,你只管设计界面!
Directus是开源开放数据平台,能将SQL数据库升级为有REST+GraphQL API的实时数据后端,提供无代码数据管理界面。它功能亮点多,技术架构优,适用于多种场景,与同类项目相比有独特优势。
文心大模型 4.5 系列正式开源,涵盖 10 余款模型
6月30日,百度正式开源文心大模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。可在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新多,性能表现优。
史上最全的AI rag技术来了!
本仓库用常见Python库讲解检索增强生成(RAG)技术,将其分解为易懂实现。包含一系列Jupyter Notebook,涉及20多种RAG技术,还介绍了核心概念、快速开始步骤等。