【博士论文】机器学习中的标记增强理论与应用研究

2024-04-13 19:32

本文主要是介绍【博士论文】机器学习中的标记增强理论与应用研究,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

b74d0a97373e5a0fcc34af9c91c94446.png

来源:专知
本文为论文,建议阅读5分钟本文对标记增强进行研究。

来自东南大学徐宁的博士论文,入选2021年度“CCF优秀博士学位论文奖”初评名单!

https://www.ccf.org.cn/Focus/2021-11-22/750448.shtml

机器学习中的标记增强理论与应用研究

标记端多义性是当今机器学习的热点问题。多标记学习中,每个样本都被赋予一组 标记子集来表示其多种语义信息。然而,标记强度差异现象在多义性机器学习任务中广 泛存在,而既有多标记学习研究中普遍采用的相关/无关两个子集的逻辑划分法几乎完 全忽视了这种现象,造成学习过程中不可避免的信息损失。针对这一突出问题,有必要 用一种称为标记分布的标注结构来代替逻辑标记对示例的类别信息进行描述。标记分布 通过连续的描述度来显式表达每个标记与数据对象的关联强度,很自然地解决了标记强 度差异的问题,而在以标记分布标注的数据集上学习的过程就称为标记分布学习。由于 描述度的标注成本更高且常常没有客观的量化标准,现实任务中大量的多义性数据仍然 是以简单逻辑标记标注的,为此本文提出了标记增强这一概念。标记增强在不增加额外 数据标注负担的前提下,挖掘训练样本中蕴含的标记重要性差异信息,将逻辑标记转化 为标记分布。

本文对标记增强进行研究,主要工作包括:构建标记增强基础理论框架。该理论框架回答了以下三个问题:第一,标记增强所 需的类别信息从何而来?即标记分布的内在生成机制;第二,标记增强的结果如何评价?即标记增强所得标记分布的质量评价机制;第三,标记增强为何有效?即标记增强对后 续分类器的泛化性能提升机制。理论分析和实验结果验证了标记增强的有效性。

提出一种面向标记分布学习的标记增强专用算法。以面向标记分布学习的标记增强 为目标专门设计的算法十分重要,其关键是如何设计能够充分挖掘数据中隐藏的标记信 息的优化目标函数。因此,本文提出一种面向标记分布学习的标记增强方法 GLLE。该 方法利用训练样本特征空间的拓扑结构以及标记间相关性,挖掘了标记强度信息,从而 生成了标记分布。实验结果验证了 GLLE 对逻辑标记数据集进行标记增强处理后使用标 记分布学习的有效性。

标记增强在其他学习范式上的应用。本文提出了基于标记增强的多标记学习方法 LEMLL,该方法将标记增强与多标记预测模型统一到同一学习目标中,使得预测模型可 以在更为丰富的监督信息下进行训练,有效地提升了学习效果。本文提出了基于标记增 强的偏标记学习方法 PLLE,该方法利用标记增强恢复候选标记的描述度,使得后续的 学习问题转化为多输出回归问题。在多标记数据集和偏标记数据集上的实验结果显示, 相较于对比算法,基于标记增强方法取得了显著更优的表现。

717da621e8e95b795848a08df67039d3.png

a305a60e5883dd2d6de657cdad9c417b.png

这篇关于【博士论文】机器学习中的标记增强理论与应用研究的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/901018

相关文章

利用Python操作Word文档页码的实际应用

《利用Python操作Word文档页码的实际应用》在撰写长篇文档时,经常需要将文档分成多个节,每个节都需要单独的页码,下面:本文主要介绍利用Python操作Word文档页码的相关资料,文中通过代码... 目录需求:文档详情:要求:该程序的功能是:总结需求:一次性处理24个文档的页码。文档详情:1、每个

Java中的分布式系统开发基于 Zookeeper 与 Dubbo 的应用案例解析

《Java中的分布式系统开发基于Zookeeper与Dubbo的应用案例解析》本文将通过实际案例,带你走进基于Zookeeper与Dubbo的分布式系统开发,本文通过实例代码给大家介绍的非常详... 目录Java 中的分布式系统开发基于 Zookeeper 与 Dubbo 的应用案例一、分布式系统中的挑战二

Java 缓存框架 Caffeine 应用场景解析

《Java缓存框架Caffeine应用场景解析》文章介绍Caffeine作为高性能Java本地缓存框架,基于W-TinyLFU算法,支持异步加载、灵活过期策略、内存安全机制及统计监控,重点解析其... 目录一、Caffeine 简介1. 框架概述1.1 Caffeine的核心优势二、Caffeine 基础2

使用Node.js和PostgreSQL构建数据库应用

《使用Node.js和PostgreSQL构建数据库应用》PostgreSQL是一个功能强大的开源关系型数据库,而Node.js是构建高效网络应用的理想平台,结合这两个技术,我们可以创建出色的数据驱动... 目录初始化项目与安装依赖建立数据库连接执行CRUD操作查询数据插入数据更新数据删除数据完整示例与最佳

PHP应用中处理限流和API节流的最佳实践

《PHP应用中处理限流和API节流的最佳实践》限流和API节流对于确保Web应用程序的可靠性、安全性和可扩展性至关重要,本文将详细介绍PHP应用中处理限流和API节流的最佳实践,下面就来和小编一起学习... 目录限流的重要性在 php 中实施限流的最佳实践使用集中式存储进行状态管理(如 Redis)采用滑动

深入浅出Spring中的@Autowired自动注入的工作原理及实践应用

《深入浅出Spring中的@Autowired自动注入的工作原理及实践应用》在Spring框架的学习旅程中,@Autowired无疑是一个高频出现却又让初学者头疼的注解,它看似简单,却蕴含着Sprin... 目录深入浅出Spring中的@Autowired:自动注入的奥秘什么是依赖注入?@Autowired

PostgreSQL简介及实战应用

《PostgreSQL简介及实战应用》PostgreSQL是一种功能强大的开源关系型数据库管理系统,以其稳定性、高性能、扩展性和复杂查询能力在众多项目中得到广泛应用,本文将从基础概念讲起,逐步深入到高... 目录前言1. PostgreSQL基础1.1 PostgreSQL简介1.2 基础语法1.3 数据库

Unity新手入门学习殿堂级知识详细讲解(图文)

《Unity新手入门学习殿堂级知识详细讲解(图文)》Unity是一款跨平台游戏引擎,支持2D/3D及VR/AR开发,核心功能模块包括图形、音频、物理等,通过可视化编辑器与脚本扩展实现开发,项目结构含A... 目录入门概述什么是 UnityUnity引擎基础认知编辑器核心操作Unity 编辑器项目模式分类工程

Python中的filter() 函数的工作原理及应用技巧

《Python中的filter()函数的工作原理及应用技巧》Python的filter()函数用于筛选序列元素,返回迭代器,适合函数式编程,相比列表推导式,内存更优,尤其适用于大数据集,结合lamb... 目录前言一、基本概念基本语法二、使用方式1. 使用 lambda 函数2. 使用普通函数3. 使用 N

Python中yield的用法和实际应用示例

《Python中yield的用法和实际应用示例》在Python中,yield关键字主要用于生成器函数(generatorfunctions)中,其目的是使函数能够像迭代器一样工作,即可以被遍历,但不会... 目录python中yield的用法详解一、引言二、yield的基本用法1、yield与生成器2、yi