LVS类型及工作原理

lvs工作原理

lvs(Linux Virtual Server),工作于layer4,其原理是根据请求报文的目标IP和PORT将其转发至后端主机集群中的某一提供服务的主机,具体转发到哪一台后端主机需要由挑选算法来决定。通俗来说,lvs的功能是通过在内核空间的netfilter上的INPUT链上的ipvs实现的,当报文由物理网络接口进入主机后,ipvs将流经至INPUT链即将进入用户空间的报文强行改变其流向,即PREROUTING-->INPUT-->POSTROUTING

lvs.png

lvs的架构

  • 调度器:director,dispatcher,balancer

  • RS:Real Server

  • CIP:Client IP

  • VIP:Director Virtual IP

  • DIP:Director IP

  • RIP:Real server IP

lvs type

lvs-nat(MASQUERADE)

lvs-nat2.png

实现过程

当客户端发出的请求报文经Director的VIP所在的物理网卡流入主机的内核空间时,报文的源IP是CIP,目标IP是VIP。此时,ipvs将强行改变报文的流经方向,即修改报文的目标IP并经DIP所在的物理网卡调度至后端的Real Server,此时,报文的源IP是CIP,而目标IP是RIP。后端RS接收报文并处理后,构建响应报文(源IP是RIP,目标IP是CIP)将经DIP发送至Director,此时,ipvs将修改报文的源IP为VIP,并经VIP所在的物理网卡发送给客户端。

功能实现的本质

多目标的DNAT(iptables),它通过修改请求报文的目标IP地址(同时可能会修改目标端口实现端口映射) 至挑选出某RS的RIP地址实现转发。

特性

  • RIP和DIP应该使用私网地址,且RS的网关要指向DIP;

  • 请求和相应报文都要经由director转发,极高负载的场景中,director可能会成为系统瓶颈;

  • 支持端口映射;

  • RS可以使用任意OS;

  • RIP和DIP必须在同一物理网络。

lvs-dr(GATEWAY)

lvs-dr2.png

几个理解要点

  • Director和RS只需要一块物理网卡;

  • Director和RS连接至同一台交换机;

  • 每台RS均配置有VIP,并且配置在lo的别名上,如,lo:0

  • 由于RS均有VIP,在路由器进行广播时,为了避免都进行相应,需进行设定,有三种方案

    • 静态绑定:在交换机的配置文件直接进行指定

    • arptables:通过arptables进行设置

    • 修改RS主机内核参数

实现过程

客户端发出的请求报文经过层层路由,到达服务器所在网络的路由器(此时报文的源IP是CIP,目标IP是VIP)。与路由器相连的交换机此时要进行广播获得Director的mac地址,路由器将报文重新进行封装(源mac是路由器的mac地址,目标mac是Director的MAC地址将),并将报文转发至Director。此时,Director亦要进行广播获得RS的mac地址,并重新将报文进行封装(目标mac是RS的mac地址)转发给交换机,交换机收到报文后根据mac转发给对应的RS。报文到达RS后由物理网卡流入内核空间,并再次经lo进入用户空间。报文处理后,构建响应报文(源IP是VIP,目标IP是CIP)经lo到物理网卡转发至路由器,响应给客户端。

实现本质

通过请求报文目标mac地址进行转发。

特性

  • 保证前端路由器将目标IP为VIP的请求发送给director;

  • RIP可以使用私有地址,也可以使用公网地址;

  • RS跟Director必须处于同一物理网络中;

  • 请求报文经Director调度,但相应报文一定不能经由Director;

  • 不支持端口映射;

  • RS可以是大多数的OS;

  • RS的网关不能指向DIP。

lvs-tun(IPIP)

lvs-tun2.png

实现本质

不修改请求报文的ip首部,而是通过在原有的ip首部之外,再封装一个ip首部。需要考虑的问题是再封装后会超出MTU,而再进行报文切片,但是一般情况下请求报文都比较小,不太可能超出MTU。

特性

  • RIP、VIP和DIP全得是公网地址;

  • RS的网关不能指向DIP;

  • 请求报文必须经由Director调度,但相应报文必须不能经由Director;

  • 不支持端口映射;

  • RS的OS必须支持隧道功能。

lvs-fullnat:

lvs-fullnat2.png

实现本质:

Director同时修改请求报文的源地址和目标地址进行转发。但是在内核中并没有支持此种模式,若要使用需要到官方网站下载补丁包。

实现过程

Director收到报文后, 将源IP(CIP)修改为(DIP),目标地址(VIP)修改为(RIP),然后经过层层路由,转发给RIP,。当RS主机收到报文后,回应时,源IP为RIP,目标IP为VIP.Director收到报文后,将源IP修改为自己(VIP), 目标IP修改为CIP。此模型适用与多机房且机房不位于同一地区。

特性

  • VIP是公网地址,RIP和DIP是私网地址,且二者无需在同一网络中;

  • RS接收到的请求报文的源地址是DIP,因此要响应给DIP;

  • 请求报文和响应报文都必须经由Director;

  • 支持断就映射机制;

  • RS可以是任意OS。

lvs scheduler

静态方法:仅根据算法本身进行调度。

  • RR:Round Robin,轮调;

  • WRR:Weighted RR,加权轮调;

  • SH:Source Hash,将来自于同一个ip的请求始终调度至同一RS,实现session保持的机制;

  • DH:Destination Hash,将对同一个目标的请求始终发往同一个RS;

动态方法:根据算法及各RS的当前负载(overhead)状态进行调度。

  • LC:Least Connection,overhead=Active*256+Inactive;

  • WLC:Weighted LC,overhead=(Active*256+Inactive)/weight;

  • SED:Shortest Expection Delay,overhead=(Active+1)*256/weight

  • NQ:Never Queue,SED算法的改进;

  • LBLC:Locality-Based LC,正向代理情况下的cache server调度;

  • LBLCR:Locality-Based Least-Connection with Replication,带复制功能的LBLC算法。

ipvsadm工具的使用

管理集群服务

ipvsadm -A|E -t|u|f service-address [-s scheduler]
ipvsadm -D -t|u|f service-address
    service-address(VIP):
        tcp: -t ip:port
        udp: -u ip:port
        fwm: -f mark
    -s scheduler:
        默认为wlc

管理集群服务中的RS

ipvsadm -a|e -t|u|f service-address -r server-address [-g|i|m] [-w weight]
ipvsadm -d -t|u|f service-address -r server-address
    server-address(RIP):
        ip[:port]
    lvs-type:
        -g: gateway,dr
        -i: ipip,tun
        -m: masquerade,nat

查看和清空

ipvsadm -C
ipvsadm -L|l [options]
    -n: numeric,基于数字 格式显示地址和端口
    -c:connection,显示ipvs连接;
    --stats:显示统计数据;
    --rate:显示速率;
    --exact:显示精确值。

保存和重载–> /etc/sysconfig/ipvsadm

ipvsadm -R --> ipvsadm--restore
ipvsadm -S --> ipvsadm--save

置零计数器

ipvsadm -Z [-t|u|f service-address]

原创文章,作者:Jeason,如若转载,请注明出处:http://www.178linux.com/62278

(0)
JeasonJeason
上一篇 2016-12-05 17:05
下一篇 2016-12-05 17:05

相关推荐

  • Keepalive+Nginx高可用配置(主从)

    Keepalived高可用集群 一、Keepalived介绍 Keepalived软件主要通过VRRP协议实现高可用功能的。VRRP是Virtual Router Redundancy Protocol(虚拟路由器冗余协议)的缩写,VRRP出现的目的就是为了解决静态路由单点故障问题,它能够保证当个别节点宕机时,整个网络可以不间断地运行。keepalived除…

    Linux干货 2016-12-30
  • 马哥linux课堂笔记

    0805课堂笔记 基本权限 读,写,执行   对于文件的读权限,能否查看文件内容.(文件内容需不需要看,如果是文本就需要看,如果是二进制就不需要看) 对于文件的写权限,能否修改文件内容,不能修改文件名,不能删除文件.(如果需要修改文件内容和文件名,必须在其父目录增加写权限和执行权限) 对于文件的执行权限,能否运行他.   对于目录的读权限…

    Linux干货 2016-08-15
  • 文本处理工具

    文本处理工具 1、查看文件内容 cat -v 显示非打印字符       -E 显示$      -T 显示TAB      -n 显示行号      -s 将连续的重复空行变成一行      -A = -vE…

    2017-07-30
  • MySQL复制: Galera

    MySQL复制: Galera mysql 主从复制 前言 Galera Replication简介 MariaDB-Galera-Server 环境部署 配置步骤 总结 前言 之前介绍了MySQL复制的各种解决方案, 但是我个人还是感觉Galera最好用也最实用, 什么是Galera, 它强大在哪里, 这篇文章就带你认识这个强大的工具 Galer…

    Linux干货 2016-04-28
  • Linux的哲学思想

    Linux的哲学思想 一切皆文件  几乎把所有的资源系统抽象为文件形式:包括硬件设备,甚至通信接口等 由众多功能单一的程序组成:一个程序只做一件事,并且做好;组合小程序完成复杂任务  力求使程序精简凝练,出现地完成最核心的需求;尽量避免使其膨胀成为一个臃肿的程序,致使大部分代码很少被需要和执行。 小程序易于理解,维护,消耗系统资源较少,易…

    Linux干货 2017-07-03
  • “Apache” 服务器中的战斗机

    一,apache世界使用排名第一的web服务器软件。它被音译为阿帕奇,与武装直升机里的佼佼者阿帕奇同名,它虽没有阿帕奇那么霸气的外观,但是它具有和它一样的强大火力,它可以运行在几乎所有广泛使用的计算机平台上,由于其跨平台和安全性被广泛使用,是最流行的Web服务器端软件之一。它快速、可靠并且可通过简单的API扩充,将Perl/Python等解释器编译到服务器中…

    2017-08-19