【Linux运维架构】LNMP企业架构之负载均衡keepalived高可用

文章目录[隐藏]

一、keepalived 高可用概述
二、keepalived是如何实现高可用的
三、高可用的keepalived使用场景
四、keepalived配置实战
五、高可用keepalived抢占式与非抢占式
六、高可用keeplived故障脑裂
七、高可用keepalived与nginx

一、keepalived 高可用概述

1.什么是高可用

一般是指2台机器启动着完全相同的业务系统，当有一台机器down机了，另外一台服务器就能快速的接管，对于访问的用户是无感知的。

2.高可用通常使用什么软件

硬件通常使用的是F5
软件通常使用keepalived

二、keepalived是如何实现高可用的

keepalived软件是基于VRRP协议实现的，VRRP是虚拟路由冗余协议，主要用于解决单点故障问题。
那么如果该负载均衡故障了，网关无法转发报文了，此时所有人都无法上网了，怎么办？

通常的做法是给路由器增加一个备份点，但是问题是，如果我们的主网关master故障了，用户是需要手动只想backup的，如果用户过多修改起来会非常麻烦。
问题一：假设用户将指向都改为backup路由器那么master路由器修好了怎么办？
问题二：假设master网关故障，我们将backup网关配置位master网关的ip是否可以？

其实是不行的，因为PC第一次通过ARP广播找到master网观点额Mac地址与ip地址后，会将信息写到ARP的缓存表中，呢么PC之后连接都是通过那么缓存表的信息去连接，然后进行数据包的转发，即使我们修改了ip但是Mac的地址是唯一的，PC的数据包依然会发送给master。（除非是通过那个缓存表过期，在次发起ARP广播的时候才能获得新的backup对应的Mac地址与ip地址）

如何才能做到出现故障自动转移，此时VRRP就出现了，我们的额VRRP其实就是通过软件或者硬件的形式在master和backup外面增加一个虚拟的Mac地址（VMAC）与虚拟ip地址（VIP），那么在这种情况下，PC请求VIP的时候，无论是master处理还是backup处理pc紧会在ARP缓存表中记录VMAC与VIP的信息。

三、高可用的keepalived使用场景

通常业务系统需要保证7*24小时不down机，比如公司内部的OA系统，每天公司人员都需要使用，则不许与down机，作为业务系统来说随时都可以用。

a.如果确定谁是主节点谁是备节点（选举投片优先级）
b.如果master故障，backup自动接管，那么master回复后会夺权吗（抢占式非抢占式）
c.如果俩台服务器都认为自己是是master会出现什么问题（脑裂）

四、keepalived配置实战

1.环境准备

主机	IP	身份
lb01	10.0.0.4	master
lb02	10.0.0.5	backup

2.在负载均衡master和backup上分别安装keeplived

[root@lb01 ~]# yum install -y keepalived
[root@lb02 ~]# yum install -y keepalived

3.配置master

编辑keepalived配置文件

[root@lb01 ~]# cat /etc/keepalived/keepalived.conf
global_defs {                     
    router_id lb01                     
}

vrrp_instance VI_1 { 
    state MASTER          
    interface eth0                   
    virtual_router_id 50         
    priority 150                        
    advert_int 1                   
    authentication {                 
        auth_type PASS      
        auth_pass 1111             
    } 
    virtual_ipaddress {         
        10.0.0.3                 
    }
}

4.配置backup

[root@lb02 ~]# cat /etc/keepalived/keepalived.conf
global_defs {
    router_id lb02
}

vrrp_instance VI_1 {
    state BACKUP        
    interface eth0
    virtual_router_id 50
    priority 100
    advert_int 1
    authentication {    
        auth_type PASS
        auth_pass 1111
    }
    virtual_ipaddress {
        10.0.0.3
    }
}

5.对比master和backup的keeplived配置的区别

Keepalived配置区别	Master节点配置	Backup节点配置
route_id（唯一标识）	router_id lb01	router_id lb02
state（角色状态）	state MASTER	state BACKUP
priority(竞选优先级)	priority 150	priority 100

6.启动master和backup节点的keepalived

#Master节点
[root@lb01 ~]# systemctl start keepalived
[root@lb01 ~]# systemctl enable keepalived

#Backup节点
[root@lb02 ~]# systemctl start keepalived
[root@lb02 ~]# systemctl enable keepalived

五、高可用keepalived抢占式与非抢占式

1.keepalived抢占式

（1）两个节点都启动的时，由于节点1的优先级高于节点2，所以VIP在节点1上面

[root@lb01 ~]# ip addr | grep 10.0.0.3
inet 10.0.0.3/32 scope global eth0

（2）关闭节点1的keepalived

[root@lb01 ~]# systemctl stop keepalived

（3）节点2联系不上节点1，主动接管VIP

[root@lb02 ~]# ip addr | grep 10.0.0.3
inet 10.0.0.3/32 scope global eth0

（4）此时重新启动master的keepalived，会发现VIP被强行抢占

[root@lb01 ~]# systemctl start keepalived
[root@lb01 ~]# ip addr | grep 10.0.0.3
    inet 10.0.0.3/32 scope global eth0

2.keepalived非抢占式

a、两个节点的state都必须配置为BACKUP
b、两个节点都必须加上配置 nopreempt
c、其中一个节点的优先级必须要高于另外一个节点的优先级。
两台服务器都角色状态启用nopreempt后，必须修改角色状态统一为BACKUP，唯一的区分就是优先级。

Master配置：

    vrrp_instance VI_1 {
        state BACKUP
        priority 150
        nopreempt
    }

Backup配置：

    vrrp_instance VI_1 {
        state BACKUP
        priority 100
        nopreempt
    }

六、高可用keeplived故障脑裂

由于某些原因，导致keepalived高可用服务器在指定时间内，无法检测到对方的心跳，各自取得资源以及服务的所有权，而此时的俩台高可用的服务器有都可以还活着

1.脑裂故障的原因

a.服务器网线松动等网络故障
b.服务器硬件故障发生损坏现象而崩溃
c,主备都开启firewalld防火墙

2.脑裂故障现象

#将节点1和节点2的防火墙都打开

[root@lb01 ~]# systemctl start firewalld
[root@lb02 ~]# systemctl start firewalld

3.解决脑裂故障的方案

如果发生闹裂，则随机kill掉一台keepalived即可。

七、高可用keepalived与nginx

1.为什么域名解析到VIP就可以访问到nginx

nginx默认监听所有的ip地址上，VIP会飘到一台节点上，相当于那台nginx多了VIP这么一网卡，所以可以访问到nginx所在机器。
如果nginx宕机，会导致用户请求失败，但是keepalived没有挂掉不会进行切换，所以需要编写一个脚本检测nginx的存活状态，如果不存活则kill掉keepalived

2.编写脚本

[root@lb01 ~]# mkdir /server/scripts
[root@lb01 ~]# vim /server/scripts/check_web.sh
#!/bin/sh
nginxpid=$(ps -C nginx --no-header|wc -l)

#1.判断Nginx是否存活,如果不存活则尝试启动Nginx
if [ $nginxpid -eq 0 ];then
    systemctl start nginx
    sleep 3
    #2.等待3秒后再次获取一次Nginx状态
    nginxpid=$(ps -C nginx --no-header|wc -l)
    #3.再次进行判断, 如Nginx还不存活则停止Keepalived,让地址进行漂移,并退出脚本  
    if [ $nginxpid -eq 0 ];then
        systemctl stop keepalived
   fi
fi

3.给脚本增加执行权限

[root@lb01 ~]# chmod +x /server/scripts/check-web.sh

4.在lb01主机的keepalived配置文件中调用此脚本

[root@lb01 ~]# cat /etc/keepalived/keepalived.conf
global_defs {           
    router_id lb01      
}
#每5秒执行一次脚本，脚本执行内容不能超过5秒，否则会中断再次重新执行脚本
vrrp_script check-web {
    script "/server/scripts/check-web.sh"
    interval 5
}

vrrp_instance VI_1 {
    state MASTER        
    interface eth0      
    virtual_router_id 50    
    priority 150        
    advert_int 1        
    authentication {    
        auth_type PASS  
        auth_pass 1111  
    }
    virtual_ipaddress {
        10.0.0.3    
    }
#调用并运行脚本
track_script {
    check-web
}
}

在Master的keepalived中调用脚本，抢占式，仅需在master配置即可。（注意，如果配置为非抢占式，那么需要两台服务器都使用该脚本）