语法
-- 核心命令
BACKUP | RESTORE
--- 备份/恢复的对象(或排除项)
TABLE [db.]table_name [AS [db.]table_name_in_backup] |
DICTIONARY [db.]dictionary_name [AS [db.]name_in_backup] |
DATABASE database_name [AS database_name_in_backup] |
TEMPORARY TABLE table_name [AS table_name_in_backup] |
VIEW view_name [AS view_name_in_backup] |
[EXCEPT TABLES ...] |
ALL [EXCEPT {TABLES|DATABASES}...] } [,...]
---
[ON CLUSTER 'cluster_name']
--- 备份目标或恢复来源
TO|FROM
File('<path>/<filename>') |
Disk('<disk_name>', '<path>/') |
S3('<S3 endpoint>/<path>', '<Access key ID>', '<Secret access key>', '<extra_credentials>') |
AzureBlobStorage('<connection string>/<url>', '<container>', '<path>', '<account name>', '<account key>')
--- 附加设置
[SETTINGS ...]
[ASYNC]有关各命令的详细信息,请参见"命令摘要"。
配置磁盘备份目标位置
为本地磁盘配置备份目标位置
在下面的示例中,你会看到备份目标位置被指定为 Disk('backups', '1.zip')。
要使用 Disk 备份引擎,首先需要在下面的路径添加一个用于指定
备份目标位置的文件:
/etc/clickhouse-server/config.d/backup_disk.xml例如,下面的配置定义了一个名为 backups 的磁盘,并将其添加到
backups 的 allowed_disk 列表中:
<clickhouse>
<storage_configuration>
<disks>
<backups>
<type>local</type>
<path>/backups/</path>
</backups>
</disks>
</storage_configuration>
<backups>
<allowed_disk>backups</allowed_disk>
<allowed_path>/backups/</allowed_path>
</backups>
</clickhouse>为 S3 磁盘配置备份目标位置
也可以通过在 ClickHouse 存储配置中配置 S3 磁盘,将 BACKUP/RESTORE 到 S3。像上文为本地磁盘所做的那样,在
/etc/clickhouse-server/config.d 中添加一个文件来配置该磁盘。
<clickhouse>
<storage_configuration>
<disks>
<s3_plain>
<type>s3_plain</type>
<endpoint></endpoint>
<access_key_id></access_key_id>
<secret_access_key></secret_access_key>
</s3_plain>
</disks>
<policies>
<s3>
<volumes>
<main>
<disk>s3_plain</disk>
</main>
</volumes>
</s3>
</policies>
</storage_configuration>
<backups>
<allowed_disk>s3_plain</allowed_disk>
</backups>
</clickhouse>对 S3 磁盘执行 BACKUP/RESTORE 的方式与本地磁盘相同:
BACKUP TABLE data TO Disk('s3_plain', 'cloud_backup');
RESTORE TABLE data AS data_restored FROM Disk('s3_plain', 'cloud_backup');本地磁盘备份/恢复使用示例
对表进行备份和恢复
运行以下命令,创建本示例中将用于备份和恢复的测试数据库和表:
设置命令
创建数据库和表:
CREATE DATABASE test_db;
CREATE TABLE test_db.test_table (
id UUID,
name String,
email String,
age UInt8,
salary UInt32,
created_at DateTime,
is_active UInt8,
department String,
score Float32,
country String
) ENGINE = MergeTree()
ORDER BY id;预处理并插入 1000 行随机数据:
INSERT INTO test_table (id, name, email, age, salary, created_at, is_active, department, score, country)
SELECT
generateUUIDv4() as id,
concat('User_', toString(rand() % 10000)) as name,
concat('user', toString(rand() % 10000), '@example.com') as email,
18 + (rand() % 65) as age,
30000 + (rand() % 100000) as salary,
now() - toIntervalSecond(rand() % 31536000) as created_at,
rand() % 2 as is_active,
arrayElement(['Engineering', 'Marketing', 'Sales', 'HR', 'Finance', 'Operations'], (rand() % 6) + 1) as department,
rand() / 4294967295.0 * 100 as score,
arrayElement(['USA', 'UK', 'Germany', 'France', 'Canada', 'Australia', 'Japan', 'Brazil'], (rand() % 8) + 1) as country
FROM numbers(1000);接下来,你需要在以下路径创建一个文件,用于指定 backup destination:
/etc/clickhouse-server/config.d/backup_disk.xml<clickhouse>
<storage_configuration>
<disks>
<backups>
<type>local</type>
<path>/backups/</path> -- 对于 MacOS,请使用:/Users/backups/
</backups>
</disks>
</storage_configuration>
<backups>
<allowed_disk>backups</allowed_disk>
<allowed_path>/backups/</allowed_path> -- 对于 MacOS,请使用:/Users/backups/
</backups>
</clickhouse>要备份该表,可以运行:
BACKUP TABLE test_db.test_table TO Disk('backups', '1.zip') ┌─id───────────────────────────────────┬─status─────────┐
1. │ 065a8baf-9db7-4393-9c3f-ba04d1e76bcd │ BACKUP_CREATED │
└──────────────────────────────────────┴────────────────┘如果该表为空,可使用以下命令从备份中恢复:
RESTORE TABLE test_db.test_table FROM Disk('backups', '1.zip') ┌─id───────────────────────────────────┬─status───┐
1. │ f29c753f-a7f2-4118-898e-0e4600cd2797 │ RESTORED │
└──────────────────────────────────────┴──────────┘要恢复已包含数据的表,请运行:
RESTORE TABLE test_db.test_table FROM Disk('backups', '1.zip')
SETTINGS allow_non_empty_tables=true表在恢复或备份时可以使用新名称:
RESTORE TABLE test_db.test_table AS test_db.test_table_renamed FROM Disk('backups', '1.zip')此备份的归档结构如下:
├── .backup
└── metadata
└── test_db
└── test_table.sql可以使用 zip 以外的格式。更多详细信息,请参阅下方的"tar 归档形式的备份"。
磁盘增量备份
ClickHouse 中的基础备份是初始的全量备份,后续的
增量备份都基于它创建。增量备份仅存储自基础备份以来
发生的更改,因此必须保留基础备份,才能从任何
增量备份中恢复。可以通过设置
base_backup 来指定基础备份的存储位置。
要为某个表创建增量备份,首先请创建一个基础备份:
BACKUP TABLE test_db.test_table TO Disk('backups', 'd.zip')BACKUP TABLE test_db.test_table TO Disk('backups', 'incremental-a.zip')
SETTINGS base_backup = Disk('backups', 'd.zip')增量备份和基础备份中的所有数据都可以通过以下命令恢复到
新表 test_db.test_table2:
RESTORE TABLE test_db.test_table AS test_db.test_table2
FROM Disk('backups', 'incremental-a.zip');保护备份
写入磁盘的备份文件可以设置密码。
可使用 password 设置指定密码。
BACKUP TABLE test_db.test_table
TO Disk('backups', 'password-protected.zip')
SETTINGS password='qwerty'要恢复受密码保护的备份,必须再次
通过 password 设置指定密码:
RESTORE TABLE test_db.test_table
FROM Disk('backups', 'password-protected.zip')
SETTINGS password='qwerty'tar 归档形式的备份
备份不仅可以存储为 zip 归档,也可以存储为 tar 归档。 其功能与 zip 相同,不同之处在于 tar 归档不支持密码保护。 此外,tar 归档还支持多种 压缩方法。
要将表备份为 tar 归档:
BACKUP TABLE test_db.test_table TO Disk('backups', '1.tar')从 tar 归档恢复:
RESTORE TABLE test_db.test_table FROM Disk('backups', '1.tar')要更改压缩方法,应在 备份名称后附加正确的文件后缀。例如,要使用 gzip 压缩 tar 归档文件,请运行:
BACKUP TABLE test_db.test_table TO Disk('backups', '1.tar.gz')支持的压缩文件后缀如下:
tar.gz.tgztar.bz2tar.lzma.tar.zst.tzst.tar.xz
压缩设置
可分别通过设置 compression_method 和 compression_level
来指定压缩方法和压缩级别。
BACKUP TABLE test_db.test_table
TO Disk('backups', 'filename.zip')
SETTINGS compression_method='lzma', compression_level=3恢复特定分区
如果需要恢复某个表的特定分区,可以显式指定这些分区。
下面创建一个简单的分区表,将数据分到四个分区中,插入一些数据,然后 仅备份第 1 和第 4 个分区:
设置
CREATE IF NOT EXISTS test_db;
-- 创建一个分区表
CREATE TABLE test_db.partitioned (
id UInt32,
data String,
partition_key UInt8
) ENGINE = MergeTree()
PARTITION BY partition_key
ORDER BY id;
INSERT INTO test_db.partitioned VALUES
(1, 'data1', 1),
(2, 'data2', 2),
(3, 'data3', 3),
(4, 'data4', 4);
SELECT count() FROM test_db.partitioned;
SELECT partition_key, count()
FROM test_db.partitioned
GROUP BY partition_key
ORDER BY partition_key; ┌─count()─┐
1. │ 4 │
└─────────┘
┌─partition_key─┬─count()─┐
1. │ 1 │ 1 │
2. │ 2 │ 1 │
3. │ 3 │ 1 │
4. │ 4 │ 1 │
└───────────────┴─────────┘运行以下命令来备份分区 1 和 4:
BACKUP TABLE test_db.partitioned PARTITIONS '1', '4'
TO Disk('backups', 'partitioned.zip')运行以下命令,恢复分区 1 和 4:
RESTORE TABLE test_db.partitioned PARTITIONS '1', '4'
FROM Disk('backups', 'partitioned.zip')
SETTINGS allow_non_empty_tables=true