PostgreSQL'de composite index kolon sırasını nasıl seçerim?
Soru
Milyonlarca satırlı bir `orders` tablom var ve en sık sorgum `WHERE user_id = X AND status = 'completed' ORDER BY created_at DESC`. Şu an çok yavaş çalışıyor; tabloda `user_id`, `status` ve `created_at` için ayrı ayrı tekli indeksler var, DB bunları Bitmap Index Scan ile birleştirmeye çalışınca maliyet patlıyor. En verimli composite index sırası ne olmalı? Kolonların seçicilik (cardinality) oranı bu sırayı nasıl etkiliyor?
Cevap
Kısa cevap: Bu sorgu için tek bir composite index kur — (user_id, status, created_at DESC). Eşitlik kolonları başa, ORDER BY kolonu en sona; gerisi kendiliğinden çözülür.
Kısa cevap
Yaşadığın yavaşlık index eksikliği değil, yanlış index biçimi: üç ayrı tekli indeksi DB Bitmap Index Scan ile birleştirip sonra ayrı bir Sort adımı çalıştırmak zorunda kalıyor, ikisi de pahalı. Aynı “sıcak tabloyu hangi kolona göre düzenlemeli” sorusunun kiracı bazlı hâlini multi-tenant izolasyon kaydında ele almıştım.
Neden
-
Eşitlik kolonları önde, sıralama kolonu sonda olmalı. B-tree, eşitlik filtresini uyguladıktan sonra satırları zaten sıralı verir; ayrı bir Sort adımına gerek kalmaz. Sıra bozulursa planlayıcı sıralamayı kendisi yapmak zorunda kalır.
-
Cardinality burada ikincil. Her iki kolon da eşitlik predicate’i olduğu için asıl kazanç sıralamayı index’e taşımakta; yine de yüksek seçicilikli kolonu (genelde
user_id) öne koymak ilk taramayı daraltır. -
Fazlalık index bedava değil. Composite’in kapsadığı tekli indeksler artık okumaya katkı vermez ama her yazmada güncellenir.
Ne yapmalı
-
(user_id, status, created_at DESC)composite index’ini kur. Eşitlik kolonları başta, ORDER BY kolonu sonda. -
DESC’i index tanımına yaz. Tek kolonda PostgreSQL index’i geriye de tarayabilir, ama composite’te yönü sabitlemek planlayıcının işini garantiler ve sıralamayı bedavaya getirir. -
EXPLAIN (ANALYZE, BUFFERS)ile doğrula. İstediğin plan tek bir Index Scan —Bitmap Index Scan+Sortdeğil. Planda hâlâ Sort görüyorsan kolon sırası ya daDESCyönü hatalıdır. -
Kapsanan tekli indeksleri sil. Composite
user_idve(user_id, status)öneklerini zaten karşılıyor; ayrıuser_id/statusindeksleri yalnızca yazmayı yavaşlatır. -
completedbaskınsa partial index düşün. Sorgularının çoğustatus = 'completed'iseWHERE status = 'completed'koşullu partial index kullan: index boyutunu küçültür, RAM’de daha çok tutabilir, yazma maliyetini düşürür.
Sonuç: Ben olsam (user_id, status, created_at DESC) composite index’ini kurar, EXPLAIN (ANALYZE, BUFFERS) ile Index Scan’e düştüğünü doğrular ve bu index’in zaten kapsadığı tekli indeksleri silerdim. Trafiğin tek bir status’e yığılıyorsa partial index’le bir tur daha sık. Indeksleme ile native SQL’in dengesi üzerine daha derin bir tartışma için sade.dev’deki yazıya bak.
İlgili Yazılar
Yorumlar
Yorum yapmak için GitHub hesabınızla giriş yapmanız yeterli. Yorumlar GitHub Discussions üzerinde saklanır.