数据库最大的宿敌竟然是它
参考文档点击文末阅读原文打开; 推荐《最好的PostgreSQL学习镜像》;
穷鬼玩PolarDB RAC系列 | 激活容灾(Standby)节点
想不到吧? 数据库最大的敌人居然是挖掘机, 没错! 为了防止它搞破坏, 投入可不小: 高昂的专线, 与主机房同级别的主机和存储硬件配置, 商业数据库软件的License. 就这还不省心, 真正被挖掘机搞断网后, 你将面临一个选择, 切还是不切?(当然不是切你的, 是切数据库的), 因为不知道切后会不会丢数据, 丢多少笔数据, 如果是涉及交易的业务(一巨大的交易真是丢一笔都赔不起), 一般容灾节点不太可能使用同步模式, 如果没有足够的redo/walj就会有丢一点数据的可能, 是不是很纠结?
系列请戳: 🏆《穷鬼玩PolarDB RAC系列》🏆
本篇文章介绍一下如何一步激活容灾(Standby)节点? 实验环境依赖 系列第一节《在Docker容器中用loop设备模拟共享存储》, 如果没有环境, 请自行参考以上文章搭建环境.
本文还依赖如下文档:
系列上一节《如何搭建PolarDB容灾(Standby)节点》
DEMO
假设你的PolarDB Standby已按前面的文档在容器pb3中部署完成, Standby 节点正常运行中.
1、pb3, 查看一下Standby节点本地数据目录
$ cd ~/standby/
$ ll
total 344
drwx------ 22 postgres postgres 4096 Dec 24 14:07 ./
drwxr-x--- 1 postgres postgres 4096 Dec 24 11:06 ../
-rw------- 1 postgres postgres 227 Dec 24 09:52 backup_label.old
-rw------- 1 postgres postgres 183650 Dec 24 09:52 backup_manifest
drwx------ 6 postgres postgres 4096 Dec 24 09:52 base/
-rw------- 1 postgres postgres 163 Dec 24 14:07 current_logfiles
drwx------ 2 postgres postgres 4096 Dec 24 14:07 global/
drwx------ 2 postgres postgres 4096 Dec 24 14:07 pg_commit_ts/
drwx------ 2 postgres postgres 4096 Dec 24 09:52 pg_dynshmem/
-rw------- 1 postgres postgres 4870 Dec 24 09:52 pg_hba.conf
-rw------- 1 postgres postgres 1636 Dec 24 09:52 pg_ident.conf
drwx------ 2 postgres postgres 4096 Dec 24 14:07 pg_log/
drwx------ 4 postgres postgres 4096 Dec 24 14:22 pg_logical/
drwx------ 2 postgres postgres 4096 Dec 24 14:07 pg_logindex/
drwx------ 4 postgres postgres 4096 Dec 24 14:07 pg_multixact/
drwx------ 2 postgres postgres 4096 Dec 24 09:52 pg_notify/
drwx------ 2 postgres postgres 4096 Dec 24 09:52 pg_replslot/
drwx------ 2 postgres postgres 4096 Dec 24 09:52 pg_serial/
drwx------ 2 postgres postgres 4096 Dec 24 09:52 pg_snapshots/
drwx------ 2 postgres postgres 4096 Dec 24 09:52 pg_stat/
drwx------ 2 postgres postgres 4096 Dec 24 09:52 pg_stat_tmp/
drwx------ 2 postgres postgres 4096 Dec 24 09:58 pg_subtrans/
drwx------ 2 postgres postgres 4096 Dec 24 09:52 pg_tblspc/
-rw------- 1 postgres postgres 3 Dec 24 09:52 PG_VERSION
drwx------ 2 postgres postgres 4096 Dec 24 14:07 pg_xact/
drwx------ 2 postgres postgres 4096 Dec 24 14:12 polar_cache_trash/
drwx------ 2 postgres postgres 4096 Dec 24 14:07 polar_fullpage/
drwx------ 2 postgres postgres 4096 Dec 24 09:52 polar_rel_size_cache/
-rw------- 1 postgres postgres 100 Dec 24 14:07 polar_settings.conf
-rw------- 1 postgres postgres 9 Dec 24 14:07 polar_shmem_stat_file
-rw------- 1 postgres postgres 505 Dec 24 09:53 postgresql.auto.conf
-rw------- 1 postgres postgres 31063 Dec 24 09:53 postgresql.conf
-rw------- 1 postgres postgres 81 Dec 24 14:07 postmaster.opts
-rw------- 1 postgres postgres 84 Dec 24 14:07 postmaster.pid
-rw------- 1 postgres postgres 0 Dec 24 09:52 standby.signal
共享盘nvme2n1中的数据目录
$ sudo pfs -C disk ls /nvme2n1/shared_data/
Dir 1 256 Tue Dec 24 09:52:52 2024 pg_multixact
Dir 1 256 Tue Dec 24 09:52:52 2024 pg_wal
Dir 1 0 Tue Dec 24 09:52:54 2024 pg_commit_ts
File 1 0 Tue Dec 24 09:52:54 2024 standby.signal
Dir 1 512 Tue Dec 24 09:52:57 2024 polar_fullpage
Dir 1 0 Tue Dec 24 09:52:57 2024 pg_replslot
Dir 1 0 Tue Dec 24 09:52:57 2024 pg_tblspc
File 1 227 Tue Dec 24 09:52:57 2024 polar_non_exclusive_backup_label
File 1 257 Tue Dec 24 09:52:57 2024 postgresql.auto.conf
Dir 1 0 Tue Dec 24 09:52:57 2024 pg_twophase
Dir 1 128 Tue Dec 24 09:52:57 2024 pg_xact
Dir 1 128 Tue Dec 24 09:53:37 2024 pg_logindex
Dir 1 7808 Tue Dec 24 09:52:57 2024 global
Dir 1 512 Tue Dec 24 09:52:58 2024 base
total 16384 (unit: 512Bytes)
2、pb3, 激活容灾(Standby)节点
$ pg_ctl promote -D ~/standby
日志如下, 有点多.
[PFSD_SDK INF Dec 24 14:27:57.278019][94]pfsd_umount_force 247: pbdname nvme2n1
[PFSD_SDK INF Dec 24 14:27:57.279200][94]chnl_connection_release_shm 1164: client umount return : deleted /var/run/pfsd//nvme2n1/94.pid
[PFSD_SDK INF Dec 24 14:27:57.279212][94]pfsd_umount_force 261: umount success for nvme2n1
waiting for server to promote...[PFSD_SDK INF Dec 24 14:27:57.380783][94]pfsd_umount_force 247: pbdname nvme2n1
[PFSD_SDK INF Dec 24 14:27:57.382082][94]chnl_connection_release_shm 1164: client umount return : deleted /var/run/pfsd//nvme2n1/94.pid
[PFSD_SDK INF Dec 24 14:27:57.382091][94]pfsd_umount_force 261: umount success for nvme2n1
.[PFSD_SDK INF Dec 24 14:27:57.583592][94]pfsd_umount_force 247: pbdname nvme2n1
...
[PFSD_SDK INF Dec 24 14:28:52.847152][94]chnl_connection_release_shm 1164: client umount return : deleted /var/run/pfsd//nvme2n1/94.pid
[PFSD_SDK INF Dec 24 14:28:52.847161][94]pfsd_umount_force 261: umount success for nvme2n1
done
server promoted
激活后是一个正常实例, 可以接收读写请求了
$ psql
psql (PostgreSQL 15.10 (PolarDB 15.10.2.0 build d4f5477d debug) on aarch64-linux-gnu)
Type "help"forhelp.
postgres=# select pg_is_in_recovery();
pg_is_in_recovery
-------------------
f
(1 row)
postgres=# create table t_new (id int);
CREATE TABLE
postgres=# insert into t_new values (1),(2),(3);
INSERT 0 3
postgres=# select * from t_new;
id
----
1
2
3
(3 rows)
postgres=# \dt
List of relations
Schema | Name | Type | Owner
--------+-------+-------+----------
public | t | table | postgres
public | t1 | table | postgres
public | t2 | table | postgres
public | t_new | table | postgres
public | tbl | table | postgres
(5 rows)
注意: 激活之后, 不能再成为原来PolarDB集群的Standby. 如果是PG的话激活之后通过pg_rewind可以回退到过去, PolarDB standby如果部署在ZFS上, 可以通过zfs快照克隆来进行回退, 省去重建Standby的动作.
观察本地数据文件目录和共享盘nvme2n1中的数据目录, 对比激活前后只有一处不同. 本地数据文件目录的standby.signal文件不存在了, 而共享盘中的还在, 说明signal文件起作用的是本地数据目录. 共享盘中的standby.signal可以删掉. 算是个小bug吧。
$ sudo pfs -C disk rm /nvme2n1/shared_data/standby.signal
参考
《穷鬼玩PolarDB RAC一写多读集群系列 | 在Docker容器中用loop设备模拟共享存储》
《穷鬼玩PolarDB RAC一写多读集群系列 | 如何搭建PolarDB容灾(Standby)节点》
《穷鬼玩PolarDB RAC一写多读集群系列 | 共享存储在线扩容》
《穷鬼玩PolarDB RAC一写多读集群系列 | 计算节点 Switchover》
《穷鬼玩PolarDB RAC一写多读集群系列 | 在线备份》
《穷鬼玩PolarDB RAC一写多读集群系列 | 在线归档》
《穷鬼玩PolarDB RAC一写多读集群系列 | 实时归档》
《穷鬼玩PolarDB RAC一写多读集群系列 | 时间点恢复(PITR)》
《穷鬼玩PolarDB RAC一写多读集群系列 | 读写分离》
《穷鬼玩PolarDB RAC一写多读集群系列 | 主机全毁, 只剩共享存储的PolarDB还有救吗?》
文末彩蛋:国产数据库周边生态
当然一款数据库要流行起来, 除了自己要强大, 还离不开生态. 用好周边生态工具, 管理水平战胜90%老司机!!! 下面简单介绍一下国产数据库周边生态.
1、管控软件
鸣嵩(前阿里云数据库总经理 / 研究员)等大佬们创业创办的云猿生, 核心产品是KubeBlocks. 他们的理念是让管理数据库和搭积木一样简单, 如果你要管理很多套并且种类(OLTP\OLAP\NoSQL\KV\TS\MQ等)很多的数据库产品, 推荐首选.
https://github.com/apecloud/kubeblocks
PG中文社区核心委员唐成老师的公司乘数开源的Clup, 专用管理PostgreSQL和PolarDB的集群管理软件, 如果你要管理很多套数据库, 推荐选择. 并且Clup还提供了企业版、自研的连接池、分布式存储、一体机、备份平台等, 是企业用户推荐之选.
https://www.csudata.com/
若航老司机开源的pigsty, 集成了300多个PG插件的PG集群和PolarDB集群管理软件, 如果你要管理很多套PG或PolarDB数据库, 且对插件有特别多的需求, 推荐选择.
https://pigsty.cc/zh/
2、审计监控诊断优化
翟总(曾经是我背后的男人)到海信聚好看后研发的 DBdoctor, 采用ebpf技术, 在对数据库几乎没有影响的情况下实时监控数据库和服务器的各项指标, 发现和诊断问题根因非常方便.
https://www.dbdoctor.cn/
天舟老哥的核心产品Bytebase 是位于您和数据库之间的中间件。它是数据库 DevOps 的 GitLab/GitHub,专为开发人员、DBA 和平台工程师打造。
https://bytebase.cc/docs/introduction/what-is-bytebase/
PawSQL, SQL优化和诊断产品.
D-Smart, Oracle老前辈白老大出品, 专注企业级市场, 将业界顶级DBA经验的产品化作品, 产品功能包括数据库监控、诊断、优化等.
https://www.modb.pro/db/567140
3、国产数据库IDE
IDE是开发者的必备工具,例如社区有pgAdmin, 国产IDE则可以看看老程序猿达刚老师的DeskUI:
https://www.deskui.com
4、数据同步&迁移&备份恢复
NineData, 老领导出去创业做的产品, 产品涵盖了数据同步、迁移、备份、比对、devops、chatDBA等.
https://www.ninedata.cloud/home
DSG, 非常老牌的数据库同步迁移企业级产品, 支持各种数据库的异构和同构迁移, 用他们的话说, 没有dsg搞不定的迁移, 比goldengate还牛.
https://www.dsgdata.com/
公开课
如果你对PolarDB学习感兴趣可以阅读这个公开课系列:
除了PolarDB还非常值得关注的几款PG栈国产数据库:
HaloDB(基于PG兼容PostgreSQL、Oracle、MySQL. http://www.halodbtech.com/ )、 IvorySQL(基于开源PG兼容PG、Oracle. https://www.ivorysql.org/zh-cn/ )、 ProtonBase(云原生分布式数仓. https://protonbase.com/ )、 成都文武数据库(https://ww-it.cn)
参考文档点击阅读原文获得
感谢关注我的github (https://github.com/digoal/blog) 及视频号: