「图像定制化」共找到 1345 篇相关文章
2025 年 InfoQ 趋势报告:云计算和 DevOps 篇
InfoQ 2025 年云计算和 DevOps 趋势报告展示技术采用阶段趋势图,介绍新增或更新技术。涉及 AI Agent、MCP、平台工程等趋势,指出云 DevOps 生态成熟有新挑战,新阶段需整合多种要素。
基于Spring AI Alibaba 的 DeepResearch 架构与实践
本文基于 SpringAI Alibaba Graph 构建 Java 版 DeepResearch 系统,实现信息搜集到报告生成的全自动流程。介绍系统能力、架构、核心功能节点及技术点,还阐述 RAG、搜索、MCP、报告生成等功能,给出使用、部署和社区参与方式。
Google DeepMind CEO Hassabis 最新访谈:未来十年实现完整 AGI,引领科学黄金时代
Google DeepMind CEO Demis Hassabis在访谈中分享诸多观点。他认为未来十年能实现完整AGI,还谈到Genie 3重新定义视频、人形机器人重要性等,指出AI创造力不足等局限,也提及旗下公司在制药等领域突破。
首个MCP架构、只50行代码就能实现高效RAG的开源框架UltraRAG 2.0
检索增强生成系统(RAG)复杂度提升,使科研人员面临高昂工程实现成本。清华大学、东北大学、OpenBMB等联合推出UltraRAG 2.0,基于MCP架构,降低技术门槛与学习成本,让科研专注创新。
OmniHuman-1.5:让数字人拥有“思考”的视频生成新范式
现有视频数字人模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。
以示范应用推动技术迭代|“幻镜”AI视听测评季正式开启!
8月19日,“幻镜”AI视听测评季在首创·郎园Station启动,由多方指导与主办。它采取“AI作品创作征集+技术测评”结合模式,首季征集“我AI北京”主题作品,将促进视听技术迭代。
隐私堡垒!Presenton开源革命:本地AI生成PPT,敏感数据永不触网!
本周GitHub新开源项目Presenton可离线制作PPT,支持主流AI模型,本地运行保护数据隐私,有灵活自定义模板和API集成功能,还具备多模型支持、主题定制等特性。
深度解读《AI 智能体的上下文工程》:构建高效 Agent 的七个宝贵教训
作者解读 Manus 团队文章,结合自身理解总结出构建高效 Agent 的 7 个关键点,如依赖上下文工程、提升 Prompt 缓存命中率等,还给出总结与核心启示,对 Agent 开发有借鉴意义。
「CV 铁三角」落定Meta,视觉 AI 如何向多模态演进?
Meta 高薪挖来「CV 铁三角」引关注,其研究成果与视觉 AI 向多模态演进路径高度贴合。他们过往十年协作,研究涵盖 S4L、BiT、ViT 等,构建起现代多模态 AI 基础框架。
医学领域也有世界模型了:精准模拟肿瘤演化,还能规划治疗方案
来自多机构学者联合提出医学世界模型(MeWM),赋予AI“预演”疾病发展的能力。它能模拟肿瘤演化,为个性化治疗提供辅助,有肿瘤演变模拟、生存风险预知和临床决策闭环三大核心功能。