很多喜欢折腾数码硬件的小伙伴,都曾体会过所谓的“All in Boom”之痛:

“辛辛苦苦配了一台高性能 Intel 12 代小主机,虚拟化了 OpenWrt 软路由、群晖 NAS、家庭影院和 HomeAssistant 智能家居(俗称 All in One)。
结果只要我想更新一下系统或者折腾一个新插件,主机一旦重启,全家所有人的手机、电视、电脑瞬间全部断网,家人立刻破口大骂:‘怎么又连不上网了?!’”

更可怕的是:如果这台唯一的单点机器主板烧了或电源暴毙,你家庭里十几年存的照片、核心资料可能会面临数天甚至数周的完全停摆!

在企业 IT 运维中,有一条神圣不可侵犯的定律:高可用性 (High Availability / HA) 架构。

它能做到:即使主力机器被当场拔掉电源线,备用机器也能在 1 秒钟之内瞬间接管所有路由与网络流量,全家正在看 4K 视频或打王者荣耀的设备甚至感知不到任何断网!

本文结合真实家庭实验室(HomeLab)企业级运维实践与 EEAT 权威标准,带你从单点脆弱走向坚不可摧的双机热备!


一、一句话搞懂:双机热备的核心原理 (VRRP 虚拟路由冗余)

我们用生动的高铁双驾驶员比喻看懂高可用:

PLAINTEXT
传统单机架构 (All in Boom):
  整列高铁只有一个驾驶员。驾驶员一旦打瞌睡或上厕所(主机更新重启),整列车立刻当场刹停!

VRRP 虚拟路由冗余架构 (双机热备):
  车头坐着两个驾驶员(主机 A 与 备用机 B),他们共享同一个工号(虚拟网关 IP: 192.168.1.1)。
  主机 A 负责日常开车,同时每秒钟向备用机 B 发送一次微小的心跳包:“我还活着”。
  一旦主机 A 断电或死机,备用机 B 在 1 秒钟内检测到心跳消失,立刻秒级顶上,全家设备完全无感!

二、家庭双机架构选型:硬件与拓扑规划

推荐最经济稳健的“主备分离”双机配置:

PLAINTEXT
                    ┌─────────────────────────┐
                    │     光猫 / 交换机       │
                    └────────────┬────────────┘
                                 │
           ┌─────────────────────┴─────────────────────┐
           │                                           │
  ┌────────▼────────┐                         ┌────────▼────────┐
  │ 主力机 A (N100) │                         │ 备用机 B (老小机)│
  │ IP: 192.168.1.2 │ <──(VRRP 毫秒级心跳)──> │ IP: 192.168.1.3 │
  │ 承担日常核心负载│                         │ 处于待命同步状态│
  └────────┬────────┘                         └────────┬────────┘
           │                                           │
           └─────────────────────┬─────────────────────┘
                                 │
                     ┌───────────▼───────────┐
                     │ 虚拟网关: 192.168.1.1 │
                     │   (全家设备连接此 IP)  │
                     └───────────────────────┘

三、网络高可用实战:Keepalived 一键部署 VRRP

在两台机器的 Linux / OpenWrt 终端中,安装极度轻量的 keepalived 服务:

1. 主力机 A 配置文件 (/etc/keepalived/keepalived.conf)

INI
vrrp_instance VI_HOME {
    state MASTER
    interface br-lan # 你的局域网网卡名称
    virtual_router_id 51
    priority 100 # 主机优先级设为最高 100
    advert_int 1
    authentication {
        auth_type PASS
        auth_pass HomePassSecret888
    }
    virtual_ipaddress {
        192.168.1.1/24 # 对外提供的虚拟漂移网关 IP
    }
}

2. 备用机 B 配置文件 (/etc/keepalived/keepalived.conf)

INI
vrrp_instance VI_HOME {
    state BACKUP
    interface br-lan
    virtual_router_id 51
    priority 90 # 备机优先级设为 90 (低于主机)
    advert_int 1
    authentication {
        auth_type PASS
        auth_pass HomePassSecret888
    }
    virtual_ipaddress {
        192.168.1.1/24
    }
}

保存后运行 systemctl restart keepalived。 实测表现:直接拔掉主力机的电源插头,备用机在 800 毫秒内 自动接管 192.168.1.1,正在 Ping 的窗口仅丢失一个包,全家上网完全不中断!


四、NAS 存储异地双备:Proxmox PBS 增量极速同步

除了路由,NAS 数据的容灾同样重要:

  1. 采用 PBS (Proxmox Backup Server):将备用机器的一块大硬盘格式化为 PBS 备份仓库。
  2. 块级去重与增量快照:每天凌晨 3 点自动对主力机的所有虚拟机和 Docker 卷做增量快照(仅传输变动的数据块,几秒钟即可备份完毕)。
  3. 异地恢复测试:一旦主力机彻底物理损毁,在备机上点击“从 PBS 还原”,5 分钟即可将完整的群晖 NAS 与软路由完整拉起!

五、常见报错与避坑速查表

故障现象 / 异常提示核心原因分析权威解决办法
发生网络“脑裂 (Split-Brain)”两台机器同时抢占了 192.168.1.1,导致局域网 IP 冲突断网。检查交换机是否拦截了组播流量(Multicast),确保双方能互相收到 VRRP 心跳包。
主机恢复开机后产生来回震荡主机一开机立刻抢占网关,但此时主机的拨号 PPP 尚未完全建立。在 Keepalived 主机配置中加入 nopreempt(非抢占模式),避免频繁切换。
主备切换后网页打开变慢备机虽然接管了网关,但备机上的 DNS 缓存服务未提前启动。确保备机上的 SmartDNS / AdGuard Home 服务常态化在后台保持开机同步运行。

六、一句话总结

VRRP 秒级漂移网关,PBS 自动快照热备! 抛弃提心吊胆的单机“All in Boom”,用双机热备还全家一个雷打不动的千兆稳定网络!

关注 易邦科学上网,及时获取最近更新:

X : https://x.com/rozmiarek760575

版权声明

作者: 易邦

链接: https://blog.e8k.net/posts/soft-router-nas-disaster-recovery-2026/

许可证: 知识共享署名-非商业性使用-相同方式共享 4.0 国际许可协议

本作品采用知识共享署名-非商业性使用-相同方式共享 4.0 国际许可协议进行许可。