Le moteur Merge (à ne pas confondre avec MergeTree) ne stocke pas lui-même les données, mais permet de lire simultanément dans un nombre quelconque d'autres tables.
La lecture est automatiquement parallélisée. L'écriture dans une telle table n'est pas prise en charge. Lors de la lecture, les index des tables effectivement lues sont utilisés, s'ils existent.
Créer une table
CREATE TABLE ... Engine=Merge(db_name, tables_regexp)Paramètres du moteur
db_name
db_name — Valeurs possibles :
- nom de base de données,
- expression constante qui renvoie une chaîne contenant un nom de base de données, par exemple
currentDatabase(), REGEXP(expression), oùexpressionest une expression régulière permettant de faire correspondre les noms de DB.
- expression constante qui renvoie une chaîne contenant un nom de base de données, par exemple
tables_regexp
tables_regexp — Une expression régulière permettant de faire correspondre les noms de table dans la ou les DB spécifiées.
Expressions régulières — re2 (prend en charge un sous-ensemble de PCRE), sensible à la casse. Voir les notes sur l’échappement des symboles dans les expressions régulières dans la section « match ».
Utilisation
Lors de la sélection des tables à lire, la table Merge elle-même n'est pas sélectionnée, même si elle correspond à la regex. Cela permet d'éviter les boucles.
Il est possible de créer deux tables Merge qui essaieront indéfiniment de lire les données l'une de l'autre, mais ce n'est pas une bonne idée.
La manière habituelle d'utiliser le moteur Merge consiste à manipuler un grand nombre de tables TinyLog comme s'il s'agissait d'une seule table.
Exemples
Exemple 1
Considérez deux bases de données, ABC_corporate_site et ABC_store. La table all_visitors contiendra les ID des tables visitors de ces deux bases de données.
CREATE TABLE all_visitors (id UInt32) ENGINE=Merge(REGEXP('ABC_*'), 'visitors');Exemple 2
Supposons que vous ayez une ancienne table WatchLog_old et que vous ayez décidé de modifier le partitionnement sans déplacer les données vers une nouvelle table WatchLog_new, et que vous deviez consulter les données des deux tables.
CREATE TABLE WatchLog_old(
date Date,
UserId Int64,
EventType String,
Cnt UInt64
)
ENGINE=MergeTree
ORDER BY (date, UserId, EventType);
INSERT INTO WatchLog_old VALUES ('2018-01-01', 1, 'hit', 3);
CREATE TABLE WatchLog_new(
date Date,
UserId Int64,
EventType String,
Cnt UInt64
)
ENGINE=MergeTree
PARTITION BY date
ORDER BY (UserId, EventType)
SETTINGS index_granularity=8192;
INSERT INTO WatchLog_new VALUES ('2018-01-02', 2, 'hit', 3);
CREATE TABLE WatchLog AS WatchLog_old ENGINE=Merge(currentDatabase(), '^WatchLog');
SELECT * FROM WatchLog;┌───────date─┬─UserId─┬─EventType─┬─Cnt─┐
│ 2018-01-01 │ 1 │ hit │ 3 │
└────────────┴────────┴───────────┴─────┘
┌───────date─┬─UserId─┬─EventType─┬─Cnt─┐
│ 2018-01-02 │ 2 │ hit │ 3 │
└────────────┴────────┴───────────┴─────┘Colonnes virtuelles
-
_table— Nom de la table à partir de laquelle les données ont été lues. Type : String.Si vous filtrez sur
_table(par exempleWHERE _table='xyz'), seules les tables qui satisfont la condition de filtrage sont lues. -
_database— Contient le nom de la base de données à partir de laquelle les données ont été lues. Type : String.
Voir aussi
- Colonnes virtuelles
- Fonction de table merge