精彩回顾 l Rust唠嗑室:Xline跨数据中心一致性管理

2024-02-05 17:40

本文主要是介绍精彩回顾 l Rust唠嗑室:Xline跨数据中心一致性管理,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

 

2022年10月15日,达坦科技和Rust语言中文社区合作,在Rust唠嗑室活动中,由达坦科技(DatenLord)联合创始人施继成做了关于开源分布式存储技术的分享,着重介绍了达坦科技新的开源项目Xline,这一跨云的metadata(元数据)KV存储的产品是如何实现高性能跨数据中心的数据一致性管理的。

内容介绍

施继成首先介绍了做Xline这个产品的动机。最初2021年UCBerkeley 提出了Sky Computing(“天空计算”)的概念。与我们都熟知的cloud computing(“云计算”)不同的是,sky computing,如其表面意义所讲,是天空中有很多的云,是解决跨云的问题。如何打破不同云之间的隔阂,或者打通和最大化利用跨云数据是当前面临的一个难题,也是我们的目标所在。如今谈论云计算时,我们不需要考虑云资源的部署,可扩展性等问题,因为云厂商已经都帮忙做了。但是,一旦跨云,则无论算力的迁移,或数据的迁移,都是摆在我们眼前要攻克的难题。达坦科技在做的就是解决“如何做跨云数据交互”的问题,我们致力于将分布式系统从数据中心范围扩散至全球范围,这样即使单个数据中心宕机,却仍不影响用户使用数据。

跨云存储最重要的是解决共识一致性的问题。随着业务量的增长,server数量也从最早的一个增长到了后来的多个。虽然可以使算力分开,让请求不会集中在一个server上,但同时也带来了挑战,即不同server间如何保证数据一致性,以及在少数server宕机时先前的决定还能够保存。不会出现“公说公有理、婆说婆有理”的局面,而是始终保留一致结果,且确保高可用性,这是共识算法想要达成的目的。

随即,施继成引入了Raft和Paxos算法的概念,简单介绍了二者的发展以及操作过程。它们的思路和传递的message大同小异,但是后者没有一个确定的leader。就传递多少message而言,没有很大差异,两者均会经过两个Round Trip Time(2RRT)才完成一个共识协议的request。

在全球数据中心间的延迟问题严重的情况下,multi-raft解决方案应运而生,其不在协议上做深究,仅做数据切片。这种情况下虽然看似完善,但是仍然存在问题。例如,如果某数据中心区域因为某些原因不available,那么运行在该数据中心的raft group就无法响应请求,其对应的数据也就不可获得了。

那是不是把该数据备份在不同的数据中心可以解决该问题呢?可以解决问题。但是正如前面提到的完成一次请求需要耗费2RRT。若放置于不同的数据中心,Latency则太大。所以,我们不经要问“是不是一定要有2RRT”?

这个问题促使大家重新审视Raft协议。需要回顾我们拥有两个RRT的原因到底是什么?一个是确定request在log中的位置,即全局顺序,另一个是分发request给followers以确保数据不被丢失。后者RRT作为共识算法的能力是无法被放弃,因此,我们就着手从前者进行完善。 

就全局顺序的原因,不得不提到MVCC的概念。MVCC要求系统维护物理或者逻辑上的时钟,而全局顺序的version就是某种程度上的逻辑时钟,刚好共识协议的log id就可以被当作是version。此时问题看似并没有得到解决,但如果假设没有contention,那也就不需要version的保护。论文“Exploiting Commutativity For Practical Fast Replication”恰巧讲的就是这个原理,即CURP协议。CURP的优势在于一方面在无冲突的情况下,一个RRT就可以完成请求,另一方面,在有冲突的情况下,可以退化成后端协议,即Raft或者Paxos等,最终保证没有请求都可以具有全局的version。

我们的产品:Xline 

基于CURP这套协议,达坦科技开发了我们的产品Xline,它是兼容etcd接口的metadata存储接口。施继成最后提出,我们最终的希望是在跨云部署的情况下可以替代etcd取得更好的性能,同时能够将CURP协议剥离出来,后续可以被其他人复用。

现在Xline项目仍然处在早期状态,已经拥有了几个接口并且做了基本的测试。但是接口方面还有待完善,以及后续稳定性方面还需要迭代。我们手动搭建了一个容器环境模拟跨云场景,手动增加网络链接的延迟,当Client和Leader在一起时,Xline延迟性方面的优越还无法体现,但当Client和Leader不在一个数据中心时,Xline的优势就相当明显,这一测试结果也符合最初我们对原理的论述。

Xline项目是以Rust语言写就,欢迎大家参与我们开源项目,GitHub链接: https://github.com/datenlord/Xline

欲观看此次Rust唠嗑室-Xline:跨数据中心一致性管理,请点击以下B站链接:

《Rust唠嗑室》第41期-开源分布式存储技术分享-施继成_哔哩哔哩_bilibili

 

这篇关于精彩回顾 l Rust唠嗑室:Xline跨数据中心一致性管理的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/681679

相关文章

综合安防管理平台LntonAIServer视频监控汇聚抖动检测算法优势

LntonAIServer视频质量诊断功能中的抖动检测是一个专门针对视频稳定性进行分析的功能。抖动通常是指视频帧之间的不必要运动,这种运动可能是由于摄像机的移动、传输中的错误或编解码问题导致的。抖动检测对于确保视频内容的平滑性和观看体验至关重要。 优势 1. 提高图像质量 - 清晰度提升:减少抖动,提高图像的清晰度和细节表现力,使得监控画面更加真实可信。 - 细节增强:在低光条件下,抖

软考系统规划与管理师考试证书含金量高吗?

2024年软考系统规划与管理师考试报名时间节点: 报名时间:2024年上半年软考将于3月中旬陆续开始报名 考试时间:上半年5月25日到28日,下半年11月9日到12日 分数线:所有科目成绩均须达到45分以上(包括45分)方可通过考试 成绩查询:可在“中国计算机技术职业资格网”上查询软考成绩 出成绩时间:预计在11月左右 证书领取时间:一般在考试成绩公布后3~4个月,各地领取时间有所不同

安全管理体系化的智慧油站开源了。

AI视频监控平台简介 AI视频监控平台是一款功能强大且简单易用的实时算法视频监控系统。它的愿景是最底层打通各大芯片厂商相互间的壁垒,省去繁琐重复的适配流程,实现芯片、算法、应用的全流程组合,从而大大减少企业级应用约95%的开发成本。用户只需在界面上进行简单的操作,就可以实现全视频的接入及布控。摄像头管理模块用于多种终端设备、智能设备的接入及管理。平台支持包括摄像头等终端感知设备接入,为整个平台提

从状态管理到性能优化:全面解析 Android Compose

文章目录 引言一、Android Compose基本概念1.1 什么是Android Compose?1.2 Compose的优势1.3 如何在项目中使用Compose 二、Compose中的状态管理2.1 状态管理的重要性2.2 Compose中的状态和数据流2.3 使用State和MutableState处理状态2.4 通过ViewModel进行状态管理 三、Compose中的列表和滚动

【Rust练习】12.枚举

练习题来自:https://practice-zh.course.rs/compound-types/enum.html 1 // 修复错误enum Number {Zero,One,Two,}enum Number1 {Zero = 0,One,Two,}// C语言风格的枚举定义enum Number2 {Zero = 0.0,One = 1.0,Two = 2.0,}fn m

Sentinel 高可用流量管理框架

Sentinel 是面向分布式服务架构的高可用流量防护组件,主要以流量为切入点,从限流、流量整形、熔断降级、系统负载保护、热点防护等多个维度来帮助开发者保障微服务的稳定性。 Sentinel 具有以下特性: 丰富的应用场景:Sentinel 承接了阿里巴巴近 10 年的双十一大促流量的核心场景,例如秒杀(即突发流量控制在系统容量可以承受的范围)、消息削峰填谷、集群流量控制、实时熔断下游不可用应

linux中使用rust语言在不同进程之间通信

第一种:使用mmap映射相同文件 fn main() {let pid = std::process::id();println!(

NGINX轻松管理10万长连接 --- 基于2GB内存的CentOS 6.5 x86-64

转自:http://blog.chinaunix.net/xmlrpc.php?r=blog/article&uid=190176&id=4234854 一 前言 当管理大量连接时,特别是只有少量活跃连接,NGINX有比较好的CPU和RAM利用率,如今是多终端保持在线的时代,更能让NGINX发挥这个优点。本文做一个简单测试,NGINX在一个普通PC虚拟机上维护100k的HTTP

PMBOK® 第六版 规划进度管理

目录 读后感—PMBOK第六版 目录 规划进度管理主要关注为整个项目期间的进度管理提供指南和方向。以下是两个案例,展示了进度管理中的复杂性和潜在的冲突: 案例一:近期,一个长期合作的客户因政策要求,急需我们为多家医院升级一个小功能。在这个过程中出现了三个主要问题: 在双方确认接口协议后,客户私自修改接口并未通知我们,直到催进度时才发现这个问题关于UI设计的部分,后台开发人员未将其传递给

Java基础回顾系列-第七天-高级编程之IO

Java基础回顾系列-第七天-高级编程之IO 文件操作字节流与字符流OutputStream字节输出流FileOutputStream InputStream字节输入流FileInputStream Writer字符输出流FileWriter Reader字符输入流字节流与字符流的区别转换流InputStreamReaderOutputStreamWriter 文件复制 字符编码内存操作流(