Tachyon源码结构分析(四)

2023-10-14 17:20
文章标签 分析 源码 结构 tachyon

本文主要是介绍Tachyon源码结构分析(四),希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

发布人: 南京大学PASA大数据实验室

前言

在上一篇《Tachyon源码结构分析(三)》中,我们分析了Master模块的源码结构,本篇接着介绍Worker模块的源码结构分析。

版本选择 
Tachyon目前最新发布的版本为0.6.1,最新的开发版本为0.7.0-SNAPSHOT。本篇我们仍然延续前几篇使用的0.6.0版本。 
官方链接:Tachyon-0.6.0

Worker模块

Worker模块是负责数据存储和管理的模块,而Master模块负责元数据的存储和管理,二者协调工作完成数据管理任务。Worker节点以层次化的存储结构(HierarchyStorage)来管理数据,数据被分层存储在Worker节点的Memory、SSD和HDD中。通过Cache替换策略,常用的数据被保存在顶层存储结构(Memory)以加快存储访问,而底层用来存储最不常被访问的数据。同时,Worker向Client提供数据服务功能,Client端通过调用WorkerServiceHandler提供的远程调用方法来完成对Worker的调度;Client通过向Worker发送申请读取数据块请求来获取Worker节点的数据;Client通过心跳保持和Worker节点的联系,失去联系后用户空间会被Worker自动回收。 
Worker模块目前由tachyon.worker包、tachyon.worker.allocation包、tachyon.worker.eviction包、tachyon.worker.hierarchy包、tachyon.worker.netty包和tachyon.worker.nio包组成。tachyon.worker包是其他几个包的父包,提供了Worker模块的通用的功能;tachyon.worker.allocation包实现了Worker节点的空间分配策略;tachyon.worker.eviction包实现了Worker节点的Cache替换策略;tachyon.worker.hierarchy包实现了Worker节点的层次存储结构;tachyon.worker.netty包以Netty框架实现了Worker节点的数据服务功能;tachyon.worker.nio以NIO方式实现了Worker节点的数据服务功能。下面我们从每个包具体分析Worker模块的实现。

  • tachyon.worker包 
    tachyon.worker包的主要功能包括向Client提供远程调用、参与与Master和Client的心跳通信、Checkpoint本地文件到底层文件系统以及提供Worker相关的通用功能。

    • 远程调用 
      Worker向Client提供远程调用的接口方便Client参与对Worker节点相关功能的调用,如访问Worker节点上的数据块、Checkpoint保存在Worker节点的文件、提升Worker节点上数据块的存储等级等。Worker提供的远程调用功能使得用户能够直接参与与数据存储的交互,TachyonFS很多对操作都是基于Worker提供的相关远程调用功能实现的。
    • 心跳 
      Worker通过心跳机制保持和Master以及Client的通信。Worker节点启动以后,向Master注册Worker节点的相关信息,之后通过定期的心跳通信保证数据的一致性。Worker节点还参与与Client的通信,Client向Worker发送心跳保持与Worker的联系,如果长时间未收到来自Client的心跳,Worker会收回分配给Client的相关用户空间。
    • Checkpoint 
      Worker节点开启了CheckpointThread线程定期Checkpoint文件。CheckpointThread线程从Master获取依赖关系的优先权列表,选择优先级较高的尚未Checkpoint的文件Checkpoint到底层文件系统,以降低Worker节点文件丢失带来的损失。
    • 其他 
      除了上述的功能,tachyon.worker包还定义了Worker节点上其他通用的操作,如BlockHandler用于处理数据块;BlocksLocker给数据块上锁;SpaceCounter管理空间分配等。此外还包含其他包会用到的一些信息,如DataServer定义了数据服务器的接口;NetworkType定义了数据服务的网络框架类型。TachyonWorker定义了Worker模块的入口函数,定义了main函数来启动Worker节点。

  • tachyon.worker.allocation包 
    tachyon.worker.allocation包是tachyon.worker的子包,实现了StorageTier上的空间分配策略。空间分配策略是在StorageTier上可用空间充足的情况下,收到requestSpace请求的时候根据空间分配策略分配指定的空间(一次只能分配同一个StorageDir下的空间)。tachyon.worker.allocation目前定义了三种空间分配策略,分别为AllocateMaxFreeAllocateRandomAllocateRR。如果没有足够的可用空间就要考虑执行替换策略了,也就是tachyon.worker.eviction包的功能。

  • tachyon.worker.eviction包 
    tachyon.worker.eviction包是tachyon.worker的子包,实现了StorageTier上的替换策略。替换策略是在可用空间不是很充足的情况下,收到requestSpace请求的时候执行替换策略替换出部分的数据块存储到下一层StorageTier,执行成功以后就可以获得足够的可用空间。tachyon.worker.eviction包目前定义了两种替换策略,即EvictLRUEvictPartialLRU。两种替换策略都是基于LRU的,区别主要在于EvictPartialLRU先筛选出具有最大可用空间且满足条件的StorageDir,然后不断使用LRU策略替换StorageDir中的数据块,而EvictLRU则每次从所有的StorageDir中使用LRU策略替换数据块,直到某个StorageDir满足条件为止。

  • tachyon.worker.hierarchy包 
    tachyon.worker.hierarchy包是tachyon.worker的子包,实现了Worker节点上层次化存储结构。层次化存储结构如下图,Worker节点上的数据以数据块为单位存储,数据块存储在StorageDir中,StorageDir被组织存储在StorageTier上。一般顶层为Memory存储层,存放被访问频率比较大的数据块。当Memory层或者SSD层空间不足的情况下,该层的数据块会被替换到下一层,下层的数据块被使用时也会提升到顶层。

  • tachyon.worker.netty包 
    tachyon.worker.netty包是tachyon.worker的子包,以Netty框架实现了Worker节点上的数据服务功能。当收到申请读取数据块的请求时,解码成BlockRequest,根据BlockRequest请求获取数据块的数据生成BlockResponse响应,编码以后反馈给申请者。

  • tachyon.worker.nio包 
    tachyon.worker.nio包是tachyon.worker的子包,和tachyon.worker.netty实现了同样的功能,即在Worker节点上提供数据服务。tachyon.worker.nioJava.nio的功能实现了数据服务器,封装了数据传输的消息,通过监听信道的方式接收resquest消息,收到消息后读取数据生成response消息写入信道发送给申请者。

这篇关于Tachyon源码结构分析(四)的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/211989

相关文章

性能分析之MySQL索引实战案例

文章目录 一、前言二、准备三、MySQL索引优化四、MySQL 索引知识回顾五、总结 一、前言 在上一讲性能工具之 JProfiler 简单登录案例分析实战中已经发现SQL没有建立索引问题,本文将一起从代码层去分析为什么没有建立索引? 开源ERP项目地址:https://gitee.com/jishenghua/JSH_ERP 二、准备 打开IDEA找到登录请求资源路径位置

JAVA智听未来一站式有声阅读平台听书系统小程序源码

智听未来,一站式有声阅读平台听书系统 🌟 开篇:遇见未来,从“智听”开始 在这个快节奏的时代,你是否渴望在忙碌的间隙,找到一片属于自己的宁静角落?是否梦想着能随时随地,沉浸在知识的海洋,或是故事的奇幻世界里?今天,就让我带你一起探索“智听未来”——这一站式有声阅读平台听书系统,它正悄悄改变着我们的阅读方式,让未来触手可及! 📚 第一站:海量资源,应有尽有 走进“智听

usaco 1.3 Mixing Milk (结构体排序 qsort) and hdu 2020(sort)

到了这题学会了结构体排序 于是回去修改了 1.2 milking cows 的算法~ 结构体排序核心: 1.结构体定义 struct Milk{int price;int milks;}milk[5000]; 2.自定义的比较函数,若返回值为正,qsort 函数判定a>b ;为负,a<b;为0,a==b; int milkcmp(const void *va,c

Java ArrayList扩容机制 (源码解读)

结论:初始长度为10,若所需长度小于1.5倍原长度,则按照1.5倍扩容。若不够用则按照所需长度扩容。 一. 明确类内部重要变量含义         1:数组默认长度         2:这是一个共享的空数组实例,用于明确创建长度为0时的ArrayList ,比如通过 new ArrayList<>(0),ArrayList 内部的数组 elementData 会指向这个 EMPTY_EL

如何在Visual Studio中调试.NET源码

今天偶然在看别人代码时,发现在他的代码里使用了Any判断List<T>是否为空。 我一般的做法是先判断是否为null,再判断Count。 看了一下Count的源码如下: 1 [__DynamicallyInvokable]2 public int Count3 {4 [__DynamicallyInvokable]5 get

SWAP作物生长模型安装教程、数据制备、敏感性分析、气候变化影响、R模型敏感性分析与贝叶斯优化、Fortran源代码分析、气候数据降尺度与变化影响分析

查看原文>>>全流程SWAP农业模型数据制备、敏感性分析及气候变化影响实践技术应用 SWAP模型是由荷兰瓦赫宁根大学开发的先进农作物模型,它综合考虑了土壤-水分-大气以及植被间的相互作用;是一种描述作物生长过程的一种机理性作物生长模型。它不但运用Richard方程,使其能够精确的模拟土壤中水分的运动,而且耦合了WOFOST作物模型使作物的生长描述更为科学。 本文让更多的科研人员和农业工作者

MOLE 2.5 分析分子通道和孔隙

软件介绍 生物大分子通道和孔隙在生物学中发挥着重要作用,例如在分子识别和酶底物特异性方面。 我们介绍了一种名为 MOLE 2.5 的高级软件工具,该工具旨在分析分子通道和孔隙。 与其他可用软件工具的基准测试表明,MOLE 2.5 相比更快、更强大、功能更丰富。作为一项新功能,MOLE 2.5 可以估算已识别通道的物理化学性质。 软件下载 https://pan.quark.cn/s/57

工厂ERP管理系统实现源码(JAVA)

工厂进销存管理系统是一个集采购管理、仓库管理、生产管理和销售管理于一体的综合解决方案。该系统旨在帮助企业优化流程、提高效率、降低成本,并实时掌握各环节的运营状况。 在采购管理方面,系统能够处理采购订单、供应商管理和采购入库等流程,确保采购过程的透明和高效。仓库管理方面,实现库存的精准管理,包括入库、出库、盘点等操作,确保库存数据的准确性和实时性。 生产管理模块则涵盖了生产计划制定、物料需求计划、

自定义类型:结构体(续)

目录 一. 结构体的内存对齐 1.1 为什么存在内存对齐? 1.2 修改默认对齐数 二. 结构体传参 三. 结构体实现位段 一. 结构体的内存对齐 在前面的文章里我们已经讲过一部分的内存对齐的知识,并举出了两个例子,我们再举出两个例子继续说明: struct S3{double a;int b;char c;};int mian(){printf("%zd\n",s

衡石分析平台使用手册-单机安装及启动

单机安装及启动​ 本文讲述如何在单机环境下进行 HENGSHI SENSE 安装的操作过程。 在安装前请确认网络环境,如果是隔离环境,无法连接互联网时,请先按照 离线环境安装依赖的指导进行依赖包的安装,然后按照本文的指导继续操作。如果网络环境可以连接互联网,请直接按照本文的指导进行安装。 准备工作​ 请参考安装环境文档准备安装环境。 配置用户与安装目录。 在操作前请检查您是否有 sud