【ICCV Oral】SAN:利用软对比学习和全能分类器提升新类发现,FaceChain团队联合出品

本文主要是介绍【ICCV Oral】SAN:利用软对比学习和全能分类器提升新类发现,FaceChain团队联合出品,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

        本文提出了一个领域适应框架Soft-contrastive All-in-one Network(SAN),旨在高效、准确、原生地控制领域间新类别的发现和适应。具体来说,SAN采用了一种新颖的基于数据增强的软对比学习(SCL)损失来微调深度神经网络,并引入了全能(All-in-One, AIO)分类器,这种策略不仅有效地解决了数据增强中的视图噪声问题,还显著提高了新类别发现的能力,同时避免了分类器的过度自信问题。相比传统的无监督领域适应(UDA)方法,SAN展现了更强的特征转移能力和更高的新类别发现准确率,其中在ODA和UNDA任务上都取得了最先进的效果。同时,我们探讨了开放集领域适应(ODA)和通用领域适应(UNDA)的核心困难和评价指标,为后续研究提供了理论基础。


论文链接:
https://arxiv.org/abs/2211.11262
代码链接:
https://github.com/zangzelin/code_SAN

一、思考的起点

        在当今的机器学习领域,领域适应已经成为了一个热门的研究方向,尤其是新类别的发现,这被视为迁移学习的一个重要应用。传统的无监督领域适应(UDA)方法在许多场景中已经证明了其有效性,但在实际应用中,我们发现它在标签稀缺的新领域中存在一些局限性。特别是在面对源领域和目标领域类别不完全重叠的情况时,传统方法往往显得力不从心。在此,源领域指的是我们已经拥有大量标签数据的领域,而目标领域则是我们希望模型能够适应但标签数据较少或完全没有的领域。这种观察促使我们重新思考:如何更有效地进行领域间的新类别发现和适应?我们需要一种方法,既能够充分利用源领域的知识,又能够灵活地适应目标领域的新类别。

二、工作亮点

        新类别的发现在领域适应中面临两大核心难点:首先是如何学习一个统一的特征表征,使其能够跨领域有效;其次是如何设计一个新类别分类器,确保其在未知类别上的鲁棒性和准确性。为了解决上述问题,我们提出了一个全新的领域适应框架——Soft-contrastive All-in-one Network(SAN)。


SAN的设计初衷是为了解决领域适应中的新类别发现问题。为此,我们首先引入了基于数据增强的软对比学习(SCL)损失。正如图1(a)所示,传统的对比学习方法在处理由于数据增强产生的视图噪声时存在问题。这种噪声会引入错误的梯度,从而损害网络的训练。此外,为所有领域找到合适的数据增强策略在面对具有巨大领域差异的UNDA数据时尤为困难。为了解决这个问题,我们提出了软对比学习(SCL)。SCL的目的是减弱视图噪声的影响,使模型能够更好地从正面对比对中学习。

然后,我们引入了全能(All-in-One, AIO)分类器。如图1(b)所示,传统的独立分类器在面对新类别时存在过度自信的问题,这导致了过于尖锐的分类边界。这种过度自信的分类边界在某些新类别上容易出错。为了解决这个问题,我们设计了AIO分类器。与传统的分类器不同,AIO分类器的决策过程更接近人类的判断方式。它假设要确定一个样本属于新类别,首先需要确定它不属于任何已知的类别。基于这个假设,我们定义了一个新的损失函数来训练AIO分类器。结果表明,与传统的分类器相比,AIO分类器具有更加平滑的分类边界,并且能够减少标签噪声的不良影响。

SCL损失的设计旨在高效、准确地控制领域间新类别的发现,通过这种策略,我们有效地解决了数据增强中的视图噪声问题。而AIO分类器则旨在解决传统分类器在新类别发现上的过度自信问题,使得模型在面对新类别时更为稳健和准确。

三、实验结果

        在本研究中,我们采用了四个在领域适应领域中广受欢迎的数据集进行训练和测试,分别是:Office、OfficeHome、VisDA和DomainNet。这些数据集涵盖了多种真实世界的场景,为模型提供了丰富的训练和验证环境。为确保实验的公正性和可靠性,我们遵循了现有的协议来将数据集进行分类,具体地,数据被分为源私有、目标私有和共享类别三部分。这种细致的数据划分策略使我们能够更为准确地评估模型在新类别发现上的性能。通过在这些数据集上的广泛测试,我们的方法在新类别发现上展现了出色的性能,证明了其在面对未知类别时的鲁棒性和准确性。

我们对SAN进行了广泛的实验评估,特别是在ODA和UNDA任务上。


实验结果显示,SAN在特征转移能力和新类别发现准确率上都取得了最先进的效果,明显超越了现有的方法。这些实验不仅验证了SAN在领域适应任务上的优越性能,还为未来的研究提供了新的方向和基准。我们采用了多种评估指标,确保了实验结果的公正性和可靠性,从而为后续研究者提供了一个坚实的基础。

我们进一步进行了可视化分析来展示SAN的效果。


图中展示了特征的t-SNE嵌入可视化,其中颜色代表不同的类别。对于图(a)中的W域到D域设置和图(b)中的D域到W域设置,我们观察到基线方法在目标域的某些新类别上犯了错误(例如,由交叉标记的散点)。这可以归因于过度自信的分类器导致的过于尖锐的分类边界,从而输出了错误的测试结果。我们认为这是过度自信的结果。与此相反,SAN很好地处理了同一类别。从这些可视化中,我们可以清楚地看到SAN在特征空间中为不同的类别创建了更加分散和清晰的聚类,这证明了其在新类别发现上的优越性能。这种可视化展示进一步证明了SAN方法在克服过度自信问题上的有效性,为新类别提供了更为鲁棒和准确的分类。

这篇关于【ICCV Oral】SAN:利用软对比学习和全能分类器提升新类发现,FaceChain团队联合出品的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/787099

相关文章

Go学习记录之runtime包深入解析

《Go学习记录之runtime包深入解析》Go语言runtime包管理运行时环境,涵盖goroutine调度、内存分配、垃圾回收、类型信息等核心功能,:本文主要介绍Go学习记录之runtime包的... 目录前言:一、runtime包内容学习1、作用:① Goroutine和并发控制:② 垃圾回收:③ 栈和

Android学习总结之Java和kotlin区别超详细分析

《Android学习总结之Java和kotlin区别超详细分析》Java和Kotlin都是用于Android开发的编程语言,它们各自具有独特的特点和优势,:本文主要介绍Android学习总结之Ja... 目录一、空安全机制真题 1:Kotlin 如何解决 Java 的 NullPointerExceptio

Linux中的more 和 less区别对比分析

《Linux中的more和less区别对比分析》在Linux/Unix系统中,more和less都是用于分页查看文本文件的命令,但less是more的增强版,功能更强大,:本文主要介绍Linu... 目录1. 基础功能对比2. 常用操作对比less 的操作3. 实际使用示例4. 为什么推荐 less?5.

基于Go语言实现Base62编码的三种方式以及对比分析

《基于Go语言实现Base62编码的三种方式以及对比分析》Base62编码是一种在字符编码中使用62个字符的编码方式,在计算机科学中,,Go语言是一种静态类型、编译型语言,它由Google开发并开源,... 目录一、标准库现状与解决方案1. 标准库对比表2. 解决方案完整实现代码(含边界处理)二、关键实现细

重新对Java的类加载器的学习方式

《重新对Java的类加载器的学习方式》:本文主要介绍重新对Java的类加载器的学习方式,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录1、介绍1.1、简介1.2、符号引用和直接引用1、符号引用2、直接引用3、符号转直接的过程2、加载流程3、类加载的分类3.1、显示

PostgreSQL 序列(Sequence) 与 Oracle 序列对比差异分析

《PostgreSQL序列(Sequence)与Oracle序列对比差异分析》PostgreSQL和Oracle都提供了序列(Sequence)功能,但在实现细节和使用方式上存在一些重要差异,... 目录PostgreSQL 序列(Sequence) 与 oracle 序列对比一 基本语法对比1.1 创建序

exfat和ntfs哪个好? U盘格式化选择NTFS与exFAT的详细区别对比

《exfat和ntfs哪个好?U盘格式化选择NTFS与exFAT的详细区别对比》exFAT和NTFS是两种常见的文件系统,它们各自具有独特的优势和适用场景,以下是关于exFAT和NTFS的详细对比... 无论你是刚入手了内置 SSD 还是便携式移动硬盘或 U 盘,都需要先将它格式化成电脑或设备能够识别的「文

Java学习手册之Filter和Listener使用方法

《Java学习手册之Filter和Listener使用方法》:本文主要介绍Java学习手册之Filter和Listener使用方法的相关资料,Filter是一种拦截器,可以在请求到达Servl... 目录一、Filter(过滤器)1. Filter 的工作原理2. Filter 的配置与使用二、Listen

基于Python打造一个全能文本处理工具

《基于Python打造一个全能文本处理工具》:本文主要介绍一个基于Python+Tkinter开发的全功能本地化文本处理工具,它不仅具备基础的格式转换功能,更集成了中文特色处理等实用功能,有需要的... 目录1. 概述:当文本处理遇上python图形界面2. 功能全景图:六大核心模块解析3.运行效果4. 相

使用Python实现全能手机虚拟键盘的示例代码

《使用Python实现全能手机虚拟键盘的示例代码》在数字化办公时代,你是否遇到过这样的场景:会议室投影电脑突然键盘失灵、躺在沙发上想远程控制书房电脑、或者需要给长辈远程协助操作?今天我要分享的Pyth... 目录一、项目概述:不止于键盘的远程控制方案1.1 创新价值1.2 技术栈全景二、需求实现步骤一、需求