掌握Redis的Sentinel哨兵原理,可助你拿到25k的offer

59 阅读3分钟

01 Redis Sentinel的意义

  • master宕机了咋整?等运维手工从主切换,再通知所有程序把地址统统改一遍重新上线?那么服务就会停滞很久,显然对于大型系统这是灾难性的!

所以必须有高可用方案,当故障发生时可自动从主切换,程序也不用重启,不必手动运维。Redis 官方就提供了这样一种方案 —— Redis Sentinel(哨兵)。

sentinal,哨兵,redis集群架构中非常重要的一个组件,主要功能如下

  • 集群监控

监控Redis master和slave进程的正常工作

  • 消息通知

如果某个Redis实例有故障,那么哨兵负责发送报警消息给管理员

  • 故障转移

若master node宕机,会自动转移到slave node上

  • 配置中心

若发生故障转移,通知client客户端新的master地址

哨兵本身也是分布式,作为一个集群运行:

  • 故障转移时,判断一个master node是否宕机,需要大部分哨兵都同意,涉及分布式选举
  • 即使部分哨兵节点宕机,哨兵集群还是能正常工作

目前采用的是sentinal 2版本,sentinal 2相对于sentinal 1来说,重写了很多代码,主要是让故障转移的机制和算法变得更加健壮和简单

哨兵 + Redis主从的部署架构不保证数据零丢失,只保证redis集群的高可用性。

1.1 为何2个节点无法正常工作?

必须部署2个以上的节点。若仅部署2个实例,quorum=1

+----+         +----+| M1 |---------| R1 || S1 |         | S2 |+----+         +----+

Configuration: quorum = 1

master宕机,s1和s2中只要有1个哨兵认为master宕机就可以进行切换,同时会在s1和s2中选举出一个执行故障转移. 但此时,需要majority,也就是大多数哨兵都是运行的,2个哨兵的majority就是2

2个哨兵的majority=2 3个哨兵的majority=2 4个哨兵的majority=2 5个哨兵的majority=3

2个哨兵都运行着,就可以允许执行故障转移

若整个M1和S1运行的机器宕机了,那么哨兵仅剩1个,此时就无majority来允许执行故障转移,虽然另外一台机器还有一个R1,但故障转移不会执行

1.2 3节点哨兵集群

       +----+       | M1 |       | S1 |       +----+          |+----+    |    +----+| R2 |----+----| R3 || S2 |         | S3 |+----+         +----+

Configuration: quorum = 2,majority

若M1节点宕机了,还剩下2个哨兵,S2和S3可以一致认为master宕机了,然后选举出一个来执行故障转移

同时3个哨兵的majority是2,所以余存的2个哨兵运行着,就可执行故障转移

02 Redis Sentinel 架构

2.1 Redis Sentinel故障转移

  1. 多个sentinel发现并确认master有问题。
  2. 选举出一个sentinel作为领导。
  3. 选出一个slave作为master.
  4. 通知其余slave成为新的master的slave.
  5. 通知客户端主从变化
  6. 等待老的master复活成为新master的slave

image.png

  • 可监控多套

image.png

03 安装与配置

  1. 配置开启主从节点
  2. 配置开启sentinel监控主节点。(sentinel是特殊的redis)
  3. 实际应该多机器
  4. 详细配置节点

image.png

image.png

Redis 主节点

[启动]redis-server redis- 7000.conf[配置]port 7000daemonize yespidfile /var/run/redis-7000.pidlogfile "7000.log"dir "/opt/soft/redis/data/"

Redis 从节点

[启动]redis-server redis-7001.confredis-server redis-7002.confslave-1[配置]port 7001daemonize yespidfile /var/run/redis-7001.pidlogfile "7001.log"dir "/opt/soft/redis/data/"slaveof 127.0.0.1 7000slave-2[配置]port 7002daemonize yespidfile /var/run/redis-7002.pidlogfile "7002.log"dir "/opt/soft/redis/data/"slaveof 127.0.0.1 7000

Sentinel 主要配置

port $(port)dir "/opt/soft/redis/data/"logfile " $(port).log"sentinel monitor mymaster 127.0.0.1 7000 2sentinel down-after-milliseconds mymaster 30000sentinel parallel-syncs mymaster 1sentinel failover-timeout mymaster 180000

3.1 演示