هذه الإعدادات متاحة في system.settings، وهي مُولَّدة تلقائيًا من المصدر.
cluster_table_function_buckets_batch_size
النوع
UInt64
القيمة الافتراضية
0
سجل الإصدارات
| الإصدار | القيمة الافتراضية | التعليق |
|---|---|---|
| 25.11 | 0 | إعداد جديد. |
يحدّد الحجم التقريبي للدفعة (بالبايت) المستخدمة في المعالجة الموزعة للمهام في دوال الجداول cluster عند استخدام مستوى تقسيم bucket. ويواصل النظام تجميع البيانات حتى يصل إلى هذا المقدار على الأقل. وقد يكون الحجم الفعلي أكبر قليلًا ليتوافق مع حدود البيانات.
cluster_table_function_split_granularity
النوع
ObjectStorageGranularityLevel
القيمة الافتراضية
file
سجل الإصدارات
| الإصدار | القيمة الافتراضية | التعليق |
|---|---|---|
| 25.11 | file | إعداد جديد. |
يتحكم هذا الإعداد في كيفية تقسيم البيانات إلى مهام عند تنفيذ دالة الجدول cluster.
يحدّد هذا الإعداد دقة توزيع العمل عبر العنقود:
file— تعالج كل مهمة ملفًا كاملًا.bucket— تُنشأ المهام لكل block بيانات داخلي داخل الملف (على سبيل المثال، row groups في Parquet).
يمكن أن يؤدي اختيار دقة أعلى (مثل bucket) إلى تحسين parallelism عند العمل مع عدد قليل من الملفات الكبيرة.
فعلى سبيل المثال، إذا كان ملف Parquet يحتوي على عدة row groups، فإن تفعيل دقة bucket يتيح معالجة كل مجموعة بشكل مستقل بواسطة workers مختلفين.