Tachyon源码结构分析(四)

2023-10-14 17:20
文章标签 分析 源码 结构 tachyon

本文主要是介绍Tachyon源码结构分析(四),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

发布人: 南京大学PASA大数据实验室

前言

在上一篇《Tachyon源码结构分析(三)》中,我们分析了Master模块的源码结构,本篇接着介绍Worker模块的源码结构分析。

版本选择 
Tachyon目前最新发布的版本为0.6.1,最新的开发版本为0.7.0-SNAPSHOT。本篇我们仍然延续前几篇使用的0.6.0版本。 
官方链接:Tachyon-0.6.0

Worker模块

Worker模块是负责数据存储和管理的模块,而Master模块负责元数据的存储和管理,二者协调工作完成数据管理任务。Worker节点以层次化的存储结构(HierarchyStorage)来管理数据,数据被分层存储在Worker节点的Memory、SSD和HDD中。通过Cache替换策略,常用的数据被保存在顶层存储结构(Memory)以加快存储访问,而底层用来存储最不常被访问的数据。同时,Worker向Client提供数据服务功能,Client端通过调用WorkerServiceHandler提供的远程调用方法来完成对Worker的调度;Client通过向Worker发送申请读取数据块请求来获取Worker节点的数据;Client通过心跳保持和Worker节点的联系,失去联系后用户空间会被Worker自动回收。 
Worker模块目前由tachyon.worker包、tachyon.worker.allocation包、tachyon.worker.eviction包、tachyon.worker.hierarchy包、tachyon.worker.netty包和tachyon.worker.nio包组成。tachyon.worker包是其他几个包的父包,提供了Worker模块的通用的功能;tachyon.worker.allocation包实现了Worker节点的空间分配策略;tachyon.worker.eviction包实现了Worker节点的Cache替换策略;tachyon.worker.hierarchy包实现了Worker节点的层次存储结构;tachyon.worker.netty包以Netty框架实现了Worker节点的数据服务功能;tachyon.worker.nio以NIO方式实现了Worker节点的数据服务功能。下面我们从每个包具体分析Worker模块的实现。

  • tachyon.worker包 
    tachyon.worker包的主要功能包括向Client提供远程调用、参与与Master和Client的心跳通信、Checkpoint本地文件到底层文件系统以及提供Worker相关的通用功能。

    • 远程调用 
      Worker向Client提供远程调用的接口方便Client参与对Worker节点相关功能的调用,如访问Worker节点上的数据块、Checkpoint保存在Worker节点的文件、提升Worker节点上数据块的存储等级等。Worker提供的远程调用功能使得用户能够直接参与与数据存储的交互,TachyonFS很多对操作都是基于Worker提供的相关远程调用功能实现的。
    • 心跳 
      Worker通过心跳机制保持和Master以及Client的通信。Worker节点启动以后,向Master注册Worker节点的相关信息,之后通过定期的心跳通信保证数据的一致性。Worker节点还参与与Client的通信,Client向Worker发送心跳保持与Worker的联系,如果长时间未收到来自Client的心跳,Worker会收回分配给Client的相关用户空间。
    • Checkpoint 
      Worker节点开启了CheckpointThread线程定期Checkpoint文件。CheckpointThread线程从Master获取依赖关系的优先权列表,选择优先级较高的尚未Checkpoint的文件Checkpoint到底层文件系统,以降低Worker节点文件丢失带来的损失。
    • 其他 
      除了上述的功能,tachyon.worker包还定义了Worker节点上其他通用的操作,如BlockHandler用于处理数据块;BlocksLocker给数据块上锁;SpaceCounter管理空间分配等。此外还包含其他包会用到的一些信息,如DataServer定义了数据服务器的接口;NetworkType定义了数据服务的网络框架类型。TachyonWorker定义了Worker模块的入口函数,定义了main函数来启动Worker节点。

  • tachyon.worker.allocation包 
    tachyon.worker.allocation包是tachyon.worker的子包,实现了StorageTier上的空间分配策略。空间分配策略是在StorageTier上可用空间充足的情况下,收到requestSpace请求的时候根据空间分配策略分配指定的空间(一次只能分配同一个StorageDir下的空间)。tachyon.worker.allocation目前定义了三种空间分配策略,分别为AllocateMaxFreeAllocateRandomAllocateRR。如果没有足够的可用空间就要考虑执行替换策略了,也就是tachyon.worker.eviction包的功能。

  • tachyon.worker.eviction包 
    tachyon.worker.eviction包是tachyon.worker的子包,实现了StorageTier上的替换策略。替换策略是在可用空间不是很充足的情况下,收到requestSpace请求的时候执行替换策略替换出部分的数据块存储到下一层StorageTier,执行成功以后就可以获得足够的可用空间。tachyon.worker.eviction包目前定义了两种替换策略,即EvictLRUEvictPartialLRU。两种替换策略都是基于LRU的,区别主要在于EvictPartialLRU先筛选出具有最大可用空间且满足条件的StorageDir,然后不断使用LRU策略替换StorageDir中的数据块,而EvictLRU则每次从所有的StorageDir中使用LRU策略替换数据块,直到某个StorageDir满足条件为止。

  • tachyon.worker.hierarchy包 
    tachyon.worker.hierarchy包是tachyon.worker的子包,实现了Worker节点上层次化存储结构。层次化存储结构如下图,Worker节点上的数据以数据块为单位存储,数据块存储在StorageDir中,StorageDir被组织存储在StorageTier上。一般顶层为Memory存储层,存放被访问频率比较大的数据块。当Memory层或者SSD层空间不足的情况下,该层的数据块会被替换到下一层,下层的数据块被使用时也会提升到顶层。

  • tachyon.worker.netty包 
    tachyon.worker.netty包是tachyon.worker的子包,以Netty框架实现了Worker节点上的数据服务功能。当收到申请读取数据块的请求时,解码成BlockRequest,根据BlockRequest请求获取数据块的数据生成BlockResponse响应,编码以后反馈给申请者。

  • tachyon.worker.nio包 
    tachyon.worker.nio包是tachyon.worker的子包,和tachyon.worker.netty实现了同样的功能,即在Worker节点上提供数据服务。tachyon.worker.nioJava.nio的功能实现了数据服务器,封装了数据传输的消息,通过监听信道的方式接收resquest消息,收到消息后读取数据生成response消息写入信道发送给申请者。

这篇关于Tachyon源码结构分析(四)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/211989

相关文章

Linux中的more 和 less区别对比分析

《Linux中的more和less区别对比分析》在Linux/Unix系统中,more和less都是用于分页查看文本文件的命令,但less是more的增强版,功能更强大,:本文主要介绍Linu... 目录1. 基础功能对比2. 常用操作对比less 的操作3. 实际使用示例4. 为什么推荐 less?5.

spring-gateway filters添加自定义过滤器实现流程分析(可插拔)

《spring-gatewayfilters添加自定义过滤器实现流程分析(可插拔)》:本文主要介绍spring-gatewayfilters添加自定义过滤器实现流程分析(可插拔),本文通过实例图... 目录需求背景需求拆解设计流程及作用域逻辑处理代码逻辑需求背景公司要求,通过公司网络代理访问的请求需要做请

Java集成Onlyoffice的示例代码及场景分析

《Java集成Onlyoffice的示例代码及场景分析》:本文主要介绍Java集成Onlyoffice的示例代码及场景分析,本文给大家介绍的非常详细,对大家的学习或工作具有一定的参考借鉴价值,需要... 需求场景:实现文档的在线编辑,团队协作总结:两个接口 + 前端页面 + 配置项接口1:一个接口,将o

IDEA下"File is read-only"可能原因分析及"找不到或无法加载主类"的问题

《IDEA下Fileisread-only可能原因分析及找不到或无法加载主类的问题》:本文主要介绍IDEA下Fileisread-only可能原因分析及找不到或无法加载主类的问题,具有很好的参... 目录1.File is read-only”可能原因2.“找不到或无法加载主类”问题的解决总结1.File

8种快速易用的Python Matplotlib数据可视化方法汇总(附源码)

《8种快速易用的PythonMatplotlib数据可视化方法汇总(附源码)》你是否曾经面对一堆复杂的数据,却不知道如何让它们变得直观易懂?别慌,Python的Matplotlib库是你数据可视化的... 目录引言1. 折线图(Line Plot)——趋势分析2. 柱状图(Bar Chart)——对比分析3

Dubbo之SPI机制的实现原理和优势分析

《Dubbo之SPI机制的实现原理和优势分析》:本文主要介绍Dubbo之SPI机制的实现原理和优势,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录Dubbo中SPI机制的实现原理和优势JDK 中的 SPI 机制解析Dubbo 中的 SPI 机制解析总结Dubbo中

C#继承之里氏替换原则分析

《C#继承之里氏替换原则分析》:本文主要介绍C#继承之里氏替换原则,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录C#里氏替换原则一.概念二.语法表现三.类型检查与转换总结C#里氏替换原则一.概念里氏替换原则是面向对象设计的基本原则之一:核心思想:所有引py

Python+PyQt5实现文件夹结构映射工具

《Python+PyQt5实现文件夹结构映射工具》在日常工作中,我们经常需要对文件夹结构进行复制和备份,本文将带来一款基于PyQt5开发的文件夹结构映射工具,感兴趣的小伙伴可以跟随小编一起学习一下... 目录概述功能亮点展示效果软件使用步骤代码解析1. 主窗口设计(FolderCopyApp)2. 拖拽路径

基于Go语言实现Base62编码的三种方式以及对比分析

《基于Go语言实现Base62编码的三种方式以及对比分析》Base62编码是一种在字符编码中使用62个字符的编码方式,在计算机科学中,,Go语言是一种静态类型、编译型语言,它由Google开发并开源,... 目录一、标准库现状与解决方案1. 标准库对比表2. 解决方案完整实现代码(含边界处理)二、关键实现细

PostgreSQL 序列(Sequence) 与 Oracle 序列对比差异分析

《PostgreSQL序列(Sequence)与Oracle序列对比差异分析》PostgreSQL和Oracle都提供了序列(Sequence)功能,但在实现细节和使用方式上存在一些重要差异,... 目录PostgreSQL 序列(Sequence) 与 oracle 序列对比一 基本语法对比1.1 创建序