南京航空航天大学学报

北大核心,CA,INSPEC,JST,Pж(AJ)

国内刊号:32-1429/V

国际刊号:1005-2615

南京航空航天大学学报杂志2025年第5期:视觉语义增强的联合小样本开集识别分类器

发布日期:

作者:丁相舒,耿传兴,陈松灿

单位:南京航空航天大学计算机科学与技术学院,南京211106;模式分析与机器智能工业和信息化部重点实验室,南京211106;,南京航空航天大学计算机科学与技术学院,南京211106;模式分析与机器智能工业和信息化部重点实验室,南京211106;,南京航空航天大学计算机科学与技术学院,南京211106;模式分析与机器智能工业和信息化部重点实验室,南京211106;

关键词:小样本开集识别;视觉-语言模型;原型分类器;分布差异;决策边界

基金:江苏省自然科学青年基金(BK20210292)。

探究了视觉-语言预训练模型对比语言-图像预训练(Contrastive language-image pre-training,CLIP)在小样本开集识别(Few-shot open-set recognition, FSOR)任务中的潜力。实验发现基于CLIP图像编码特征的视觉原型分类器通常不如传统FSOR基线方法;基于CLIP语义编码特征的语义原型分类器虽然在闭集分类上显著优于传统基线,但在开集识别方面表现不佳。本文分析造成这些问题的主要原因可能是CLIP的训练数据与FSOR目标数据之间的分布差异及CLIP语义原型分类器为已知类别划分了过大的决策边界。本文提出了一种简单有效的视觉语义增强的联合小样本开集分类器,其不仅充分利用CLIP语义原型分类器的闭集分类优势,还巧妙挖掘了传统FSOR预训练模型构建的视觉原型分类器的潜力,以更紧密的决策边界进一步提升开集识别的精准度。在4个基准数据集上的实验结果表明,该方法在准确率(Accuracy,ACC)和受试者工作特征曲线下的面积(Area under the receiver operating characteristic,AUROC)指标上相比最优基线平均提升了2.9%和2.6%。

来源:2025年第5期

《南京航空航天大学学报》期刊编辑部

查看南京航空航天大学学报杂志2025年第5期

联系我们

  • 地址:南京市御道街29号
  • 电话:025-84892726
  • E-mail:tnc01@nuaa.edu.cn

咨询工作人员