什么是高可用双击热备,?一般指2台机器启动着相同的业务系统,当有一台机器down机了,?另外一台服务器能快速的接管,?对于访问的用户是无感知的。
那么高可用使用在什么场景,业务系统需要保证7x24小时不DOWN机,?作为业务来说随时都可用,?让你的业务系统更顽强。
keepalived
????lb01:nginx负载均衡(完全一致)
????lb02:nginx负载均衡(完全一致)
????keepalived仅能实现地址漂移
keepalived+nginx负载均衡高可用
lb01和lb02必须完完全全一致,这样才可以实现无缝切换
服务器系统 ?角色 外网IP 内网IP
CentOS?7.5 ?keepalived-master eth0:10.0.0.5 eth1:172.16.1.5
CentOS?7.5 ?keepalived-slave eth0:10.0.0.6 eth1:172.16.1.6
在lb01与lb02上分别安装keepalived
[root@lb01 ~]# yum install keepalived -y
[root@lb02 ~]# yum install keepalived -y
配置lb01, keepalived-master
[root@lb01 ~]# cat /etc/keepalived/keepalived.conf
global_defs {
router_id lb01
}
vrrp_instance VI_1 {
state MASTER
interface eth0
virtual_router_id 50
priority 150
advert_int 1
authentication {
auth_type PASS
auth_pass 1111
}
virtual_ipaddress {
10.0.0.3
}
}
配置lb02, keepalived-backup
[root@lb02 ~]# cat /etc/keepalived/keepalived.conf
global_defs {
router_id lb02
}
vrrp_instance VI_1 {
state BACKUP
interface eth0
virtual_router_id 50
priority 100
advert_int 1
authentication {
auth_type PASS
auth_pass 1111
}
virtual_ipaddress {
10.0.0.3
}
}
对比keepalived的master与backup配置的区别
Keepalived配置区别 ????Master配置 ????Backup节配置
route_id(唯一标识) ????route_id?lb01 route_id?lb02
state(角色状态) ????????state?Master state?Backup
priority(竞选优先级) priority?150 priority?100
快速配置一台负载均衡服务器
[root@lb02 ~]# scp -rp root@172.16.1.5:/etc/yum.repos.d /etc/
[root@lb02 ~]# yum install nginx -y
[root@lb02 ~]# scp -rp root@172.16.1.5:/etc/nginx /etc/
[root@lb02 ~]# systemctl start nginx
[root@lb02 ~]# systemctl enable nginx
1.只有在物理服务器的情况,并且公司的业务不允许DOWN机(7x24),才会使用keepalived
2.互联网公司
????1.购买SLB->选择购买的连接数-->升级
????2.自带高可用
????2.自带高可用
由于某些原因,导致两台keepalived高可用服务器在指定时间内,无法检测到对方的心跳消息,各自取得资源及服务的所有权,而此时的两台高可用服务器又都还活着。
服务器网线松动等网络故障
服务器硬件故障发生损坏现象而崩溃
主备都开启firewalld防火墙
Nginx服务死掉等
在备上编写检测脚本,?测试如果能ping通主并且备节点还有VIP的话则认为产生了列脑
[root@lb02 ~]# cat check_split_brain.sh
#!/bin/sh
lb01_vip=10.0.0.3
lb01_ip=10.0.0.5
while true;do
ping -c 2 -W 3 $lb01_ip &>/dev/null
if [ $? -eq 0 -a `ip add|grep "$lb01_vip"|wc -l` -eq 1 ];then
echo "ha is split brain.warning."
else
echo "ha is ok"
fi
sleep 5
done
如果Nginx宕机,?会导致用户请求失败,?但Keepalived并不会进行切换,?所以需要编写一个脚本检测Nginx的存活状态,?如果不存活则kill?nginx和keepalived
[root@lb01 ~]# mkdir /server/scripts
[root@lb01 ~]# vim /server/scripts/check_web.sh
#!/bin/sh
#使用while死循环
while true;do
nginxpid=$(ps -C nginx --no-header|wc -l)
#1.判断Nginx是否存活,如果不存活则尝试启动Nginx
if [ $nginxpid -eq 0 ];then
systemctl start nginx
sleep 5
#2.5秒后再次获取一次Nginx状态
nginxpid=$(ps -C nginx --no-header|wc -l)
#3.再次进行判断, 如Nginx还不存活则停止Keepalived,让地址进行漂移,并退出脚本
if [ $nginxpid -eq 0 ];then
systemctl stop keepalived
exit 1
fi
fi
sleep 5
done
[root@lb01 ~]# chmod +x /server/scripts/check_web.sh
????7x24小时不DOWN场景
????2台服务器
????????主??????????优先级150??????virtu_router_id??50??????lb01
????????备??????????优先级100??????virtu_router_id??50??????lb02
(主和备上面都有虚拟IP?--->俗称VIP)
????????解决办法:执行脚本
1.keepalived造成故障:主和备上都编写一个脚本:
1.备判断自己是否能ping通主
2.检查自己是否存在VIP
3.建议使用kill命令杀死备机的keepalived
2.Nginx故障,导致请求通过VIP找到Master服务器无法提供服务。
1.检查Nginx的进程是否存在,如果存在则sleep?5秒,再次检查
2.如果不存在,则尝试启动一次Nginx
3.如果启动成功,进入下一步,sleep?5秒
4.如果启动不成功,强制杀掉keepalived让地址漂移至备机
5.建议写在Master上面即可。
1.互联网--->使用公有云的??(LB)
2.公有云不能使用keepalived工具,公有云本身负载均衡支持高可用
我们使用公有云的LB负载均衡,本身厂商就支持高可用,所以这一块我们没做考虑。
但:如果贵公司使用的是硬件服务器,那么也可以使用keepalived开源软件实现高可用。
原文:https://www.cnblogs.com/wenrulaogou/p/12095226.html