「GPT Image 2.5」共找到 3630 篇相关文章
AI生图大洗牌!流匹配架构颠覆传统,一个模型同时接受文本和图像输入
AI生图有新突破,新模型FLUX.1 Kontext用流匹配架构,与此前技术不同,能接受文本和图像输入。其来自Black Forest Labs,有编辑和生成能力,还具备4个特性,第三方测试也给出提示词使用技巧。
科学家把大脑切片接上机械手,它自己学会了弹琴
法国国家科学研究中心等机构研究人员将死者脑切片放培养皿,连接机械手,经训练机械手学会曲子。研究证实学习依赖神经活动,虽成果距应用远,但为脑科学研究提供观察窗口,也引发伦理思考。
RAG创新了,MCompassRAG装上了语义指南针
RAG系统存在chunk切分难题,现有方案有额外成本。MCompassRAG不切细、不rerank,给粗chunk加主题元数据当指南针,训练推理分离,实验显示信息效率提升、延迟降低。
对话英韧科技刘刚:AI浪起,从芯到盘的存储马拉松与国产破局
2026年存储行业受AI驱动变革,存力成新“卡脖子”环节。英韧科技CEO刘刚在闪存峰会接受采访,谈及技术、市场与战略,展现企业在AI浪潮中的生存法则与战略取舍,如技术超前布局、“以模组促主控”等。
西交大 x A*STAR 论文:让 AI 学会「保持一致」,多图生成迎来关键突破丨CVPR 2026
西安交大与新加坡A*STAR团队提出论文《PaCo-RL: Advancing Reinforcement Learning for Consistent Image Generation with Pairwise Reward Modeling 》,将一致性问题转为“跨图比较”学习问题,结合强化学习实现能力闭环,提升多图生成一致性。
OpenAI推理第一人创业了:要造“活到老学到老”的AI,先来融它70个亿
OpenAI推理模型第一人Jerry Tworek离职不到一个月就创业,新公司Core Automation计划筹集10亿美元,要做具备「持续学习」能力的新型AI模型,解决主流模型‘训完就上线’、能力固定的问题。
Qwen-lmage-Layered:图片分层 指哪改哪
全新图像生成模型Qwen-lmage-Layered采用自研架构,将图片“拆解”成多个图层,各图层可独立操作。其提出新编辑思路,有RGBA - VAE等亮点,支持灵活迭代分解,能实现精准高效的图像编辑。
火线解析MiniMax招股书!全球领先大模型成本只有OpenAI 1%,果然拳怕少壮
上海大模型独角兽MiniMax通过港交所聆讯冲刺IPO。它是全球化AGI科技公司,全模态能力领先且成本低。技术上各模态模型表现出色,采用“模型即产品”模式获客,财务业绩向好,团队年轻高效。
倒计时3周离职!LeCun最后警告:硅谷已陷入集体幻觉
LeCun三周后将从Meta离职,在最新访谈中警告,硅谷对大模型的追捧是集体幻觉,大模型无法通往AGI。他认为世界模型才是正途,还分享了创业公司AMI的规划,批评了硅谷单一文化,对AGI时间线给出看法。
SpecKit 在成熟 Java 项目中的 AI 编码实践
文章分享SpecKit在成熟Java项目的AI编码实践,引入其作为规范管理工具,按标准化流程操作。介绍选型、环境准备、执行步骤,分析优缺点,还提及Qwen - Image解决AI绘画文字问题。