distributed_plan_default_reader_bucket_count
分散クエリで並列読み取りを行う際のデフォルトのタスク数です。タスクはレプリカ間に分散されます。 ルールベースの分散プランナーで使用されます。コストベースのオプティマイザは推定コストに基づいて読み取りのファンアウトを選択するため、この設定は使用しません。distributed_plan_default_shuffle_join_bucket_count
分散 shuffle-hash-join のデフォルトのバケット数。 ルールベースの分散プランナーで使用されます。コストベースのオプティマイザは推定コストに基づいてファンアウトを選択するため、この設定は使用しません。distributed_plan_execute_locally
分散クエリプランのすべてのタスクをローカルで実行します。テストやデバッグに有用です。distributed_plan_fallback_to_local_execution
クエリプランに分散実行に対応していないステップが含まれている場合、例外をスローするのではなく、その理由をログに記録してイニシエーター上でクエリを実行します。無効にすると、代わりに例外がスローされます。make_distributed_plan (プライベートプレビュー) が有効な場合にのみ有効になります。
distributed_plan_force_exchange_kind
分散クエリのステージ間で、指定した種類の Exchange 演算子を強制します。 設定可能な値:- ” - どの種類の Exchange 演算子も強制せず、オプティマイザに選択させます。
- ‘Persisted’ - オブジェクトストレージ内の一時ファイルを使用します。
- ‘Streaming’ - Exchange データをネットワーク経由でストリーミングします。
distributed_plan_force_shuffle_aggregation
分散クエリプランでは、PartialAggregation + Merge の代わりに Shuffle 集約戦略を使用します。 Shuffle 戦略が正しい結果を生成できない場合、たとえばGROUPING SETS の場合や、集約が bucket 順で結果を生成しなければならない場合には無視されます。
distributed_plan_max_rows_to_broadcast
分散クエリプランで、shuffle join の代わりに broadcast join を使用する際の最大行数。 ルールベースの分散プランナーにおけるヒューリスティックです。コストベースのオプティマイザが有効な場合、broadcast と shuffle の選択は推定コストに基づいて行われるため、この設定は効果がありません。distributed_plan_optimize_exchanges
分散クエリプラン内の不要な Exchange を削除します。デバッグ時は無効にしてください。distributed_plan_prefer_replicas_over_workers
レプリカで実行できるよう、分散クエリプランをシリアライズします。distributed_plan_read_in_order
分散クエリプランにおけるORDER BY の read-in-order 最適化を許可します。これにより、スキャンしてソートする代わりに、テーブルのソーティングキー順に読み取ることでソートを省略し、早期に処理を打ち切れます。
デフォルトでは無効です。ソートを分散させる rewrite は、対象のソートが「入力が既に順序付けられていること」に依存しないことを前提としていますが、実際に依存するソートに対しては、順序を保持しない exchange を経由して行が供給される可能性があります。現時点で安全なのは、読み取りとソートの間に exchange が残らない shape のみです。