「影像自动化」共找到 502 篇相关文章
nnU-Net:医学图像分割的自适应自动化框架
德国癌症研究中心团队提出 nnU-Net 自配置医学图像分割框架,能根据数据集特征自动推导预处理、网络拓扑等策略获稳健分割基线。文章介绍其原理、优缺点、评测案例及 Python 代码实现。
不要建一千个 Agent:Ramp 如何用一个 Agent 搞定金融自动化
美国企业金融平台 Ramp 估值 320 亿美元,在 The Pragmatic Summit 分享 AI 实战经验。介绍了从“建一堆 Agent”转向“一个 Agent + 一千种技能”架构,Policy Agent 开发过程,定义“正确”标准,建内部 AI 基础设施及内部编码 Agent 情况。
让AI评测AI:构建智能客服的自动化运营Agent体系
文章介绍智能客服发展,从传统机器人客服到基于AI原生的智能客服。重点探讨对话效果评测,搭建运营Agent平台,实现服务闭环。还提及评测落地方法、难题及解决措施,最后阐述AI在服务链路提效和分析转人工原因的作用。
北大、字节、中科院自动化研究所等提出图像并行生成新范式
北大、字节等团队发现多模态模型先思考后作画会降低图像语义保真度,因自回归架构有误差传播问题。为此提出并行多模态扩散框架MMaDA - Parallel,构建ParaBench基准,多项优化后在测试中击败Bagel。
AI 当导演编剧和剪辑?FilMaster打开自动化电影创作新纪元
当前多数AI电影生成系统难达‘专业级’,香港大学推出FilMaster系统。它融合摄影语言与后期制作流程,分两阶段创作电影,能生成高质量作品,但高级后期制作技术未纳入。
Codex自改进Prompt:让AI自己把重复工作变成自动化
开发者Vaibhav更新的Codex自改进Prompt引发AI开发者群体讨论,被OpenAI联合创始人转发。完整版核心逻辑可拆解为8步,加了严格跳过规则。实测有反馈,也有优化建议和现存问题。
代码Agent的苦涩教训!首次拆解上下文检索,直指自动化软件瓶颈
ContextBench首次从「过程」评测代码智能体,揭示当前模型多读少用、被关键词误导等深层问题。它基于真实问题修复任务,由专家标注「黄金上下文」,用多指标评估。研究显示,复杂架构未必效果好,模型重召回轻精确等。
开源PDF表单自动化神器,一行命令,把静态 PDF 变成交互表单!
平时拿到的PDF表单大多无法直接填写,操作繁琐。GitHub上的开源工具CommonForms能自动识别PDF表单区域,一键生成可填写的交互式表单,基于深度学习模型FFDNet,功能强大且使用简单,还保障数据隐私。
夜光影像里的"暗船":双分支 YOLO11 如何用抓非法捕捞
非法捕捞的暗船常关掉 AIS 隐身,难被传统手段监控。论文提出双分支 YOLO11,通过夜光遥感数据精准检测,还设计预处理流程,在测试集表现优,规模化应用也得到暗船率等成果。
临床PK完胜ChatGPT-5!国内团队造出首个OCT影像AI系统
近日,空军军医大学李妍教授团队与深圳清华大学研究院朱锐团队联合完成的COMPARE研究发表。其构建的CA - GPT系统在PCI决策制定上显著优于ChatGPT - 5,有望重新定义心脏介入手术智能化标准。