PostgreSQL'de composite index kolon sırasını nasıl seçerim?
Soru
Milyonlarca satırlı bir `orders` tablom var ve en sık sorgum `WHERE user_id = X AND status = 'completed' ORDER BY created_at DESC`. Şu an çok yavaş çalışıyor; tabloda `user_id`, `status` ve `created_at` için ayrı ayrı tekli indeksler var, DB bunları Bitmap Index Scan ile birleştirmeye çalışınca maliyet patlıyor. En verimli composite index sırası ne olmalı? Kolonların seçicilik (cardinality) oranı bu sırayı nasıl etkiliyor?
Cevap
Kısa cevap: Bu sorgu için tek bir composite index kur — (user_id, status, created_at DESC). Eşitlik kolonları başa, ORDER BY kolonu en sona; gerisi kendiliğinden çözülür.
Yaşadığın yavaşlık index eksikliği değil, yanlış index biçimi: üç ayrı tekli indeksi DB Bitmap Index Scan ile birleştirip sonra ayrı bir Sort adımı çalıştırmak zorunda kalıyor, ikisi de pahalı.
- Önce eşitlik kolonları, sonra sıralama kolonu. Kural net:
WHERE’de eşitlikle (=) süzdüğün kolonlar index’in başında olur — buradauser_idvestatus. ORDER BY’a giren kolon ise en sona gelir:(user_id, status, created_at DESC). Böylece B-tree, eşitlik filtresini uyguladıktan sonra satırları zatencreated_at DESCsırasında verir; ayrı Sort adımına gerek kalmaz. DESC’i index’e yaz. Sıralaman tek yönlüyse (created_at DESC) bunu index tanımına koy. Tek kolonda PostgreSQL index’i geriye de tarayabilir, ama composite’te yönü sabitlemek planlayıcının işini garantiler ve sıralamayı bedavaya getirir.- Cardinality eşit eşitliklerde ikincil. Cardinality, hangi eşitlik kolonunun önde olacağını etkiler; ama burada ikisi de eşitlik predicate’i, yani asıl kazanç sıralamayı index’e taşımakta. Yine de yüksek seçicilikli kolonu (genelde
user_id) öne koymak ilk taramayı daraltır. EXPLAIN (ANALYZE, BUFFERS)ile doğrula. İstediğin plan tek bir Index Scan —Bitmap Index Scan+Sortdeğil. Planda hâlâ Sort görüyorsan kolon sırası ya daDESCyönü hatalıdır.completedbaskınsa partial index düşün. Sorgularının çoğustatus = 'completed'iseWHERE status = 'completed'koşullu partial index index’i küçültür, RAM’de daha çok tutar, yazma maliyetini düşürür.
Sonuç: Ben olsam (user_id, status, created_at DESC) composite index’ini kurar, EXPLAIN (ANALYZE, BUFFERS) ile Index Scan’e düştüğünü doğrular ve bu index’in zaten kapsadığı tekli user_id/status indekslerini silerdim — fazlalık index sadece yazmayı yavaşlatır. Trafiğin tek bir status’e yığılıyorsa partial index’le bir tur daha sık. Indeksleme ile native SQL’in dengesi üzerine daha derin bir tartışma için sade.dev’deki yazıya bak.
İlgili Yazılar
Yorumlar
Yorum yapmak için GitHub hesabınızla giriş yapmanız yeterli. Yorumlar GitHub Discussions üzerinde saklanır.