多粒度编辑」共找到 4255 篇相关文章

开源动态8

PaddleOCR 3.0发布:OCR精度跃升13%,支持语种、手写体与高精度文档解析

2025年5月20日,飞桨团队发布并开源PaddleOCR 3.0,适配飞桨框架3.0正式版。其提升文字识别精度,支持文字类型和手写体识别,满足复杂文档解析需求,结合文心大模型4.5 Turbo提升关键信息抽取精度,还新增国产硬件支持。

开源AI项目落地
产品应用8

理解、生成、编辑一次搞定:Skywork UniPic 2.0的统一模态解法|甲子光年

电商团队常面临创作流程繁琐问题,当前行业需统一架构。昆仑万维发布Skywork UniPic 2.0,整合理解、生成、编辑功能。它参数小性能优,还构建奖励模型,配合其他模型构建体系,具成本等优势。

甲子光年
算法论文8

终结智能体视觉幻觉“滚雪球”!新国立等提出ViF:无需改造模型,即插即用

智能体协同做视觉任务常轮次越错得越离谱,根源是信息传递方式有缺陷。新国立等研究人员提出轻量通用的ViF范式,无需改造基座模型,可大幅压制幻觉滚雪球,已入选ICLR 2026。

量子位
算法论文8

CMAME | 西安交通大学海春龙、梅立泉等:基于分层神经网络的在线保真度数据融合

在工业应用中,高保真数据获取成本高,低保真数据准确性不足。本文提出基于分层神经网络的在线保真度数据融合方法(OMA - HNN),含MA - HNN和在线渐进采样框架,经测试验证了其有效性和实用性。

力学与人工智能
开源动态8

告别AI“乱画图表”!港中文团队发布首个结构化图像生成编辑系统

现有AI生图工具在结构化图像生成上问题,理解与生成能力有鸿沟。港中文等校联合团队提出首个综合性方案,涵盖数据集构建、模型优化、评估基准三大模块,助模态模型画准图,推动其发展。

量子位
算法论文7

SMO | 西工大宁晨伽、张伟伟等:基于共享并行神经网络架构的精度气动融合方法

高可靠性气动数据降本增效是关键命题。本研究总结主流精度建模方法,提出基于共享并行架构的融合策略,区分公共与私有特征,提升融合框架表征能力,还通过算例验证方法有效性。

力学与人工智能
算法论文8

用“因果规划”解决智能体协作中的任务依赖难题|港科广&腾讯

港科广和腾讯研究团队提出CausalMACE方法,将因果推理机制引入开放世界智能体系统。该方法含全局因果任务图,框架分“判断”“规划”“执行”环节,在基准任务中表现出色,已中稿EMNLP 2025 Findings。

量子位
开源动态8

微软开源2周狂赚7.2K star!!轻量好用命令行编辑利器,程序员力荐!

微软开源命令行文本编辑器`Edit`,专为Windows Terminal设计,支持系统。它轻量高效,功能丰富,兼容Windows生态,还有鼠标模式。开源半月获7.2K+ star,提供种安装方式。

开源先锋
产品应用8

Claude推出智能体代码审查系统:Anthropic内部同款,接管PR深度抓Bug

Anthropic为Claude Code引入代码审查系统,复刻内部审查机制,调度智能体揪深层Bug。该功能面向团队和企业版用户预览,审查更彻底,虽成本高但有效提升审查质量,还能自定义规则、管控成本。

AI寒武纪
开源动态8

ICLR 2026|滑铁卢大学联合可灵提出UniVideo:统一视频理解、生成、编辑模态

滑铁卢大学与快手可灵团队提出 UniVideo,是支持视频理解、生成与编辑模态模型。它采用双流架构,结合 MLLM 与 MM - DiT 能力,统一 10 个模态任务,在项基准超现有方法,代码已开源。

机器之心