Dobór indeksów dla szeregów czasowych
Wybierać właściwe indeksy dla obciążeń szeregów czasowych — indeks złożony (device_id, ts DESC) obsługuje typowy wzorzec
Dobór indeksów dla szeregów czasowych to bezpłatna lekcja SQL Academy na CoddyKit. To lekcja 4 z 4. Możesz przeczytać całą lekcję poniżej za darmo — a potem ćwiczyć ją interaktywnie w przeglądarce z wbudowanym edytorem kodu i tutorem AI dostępnym 24/7. To część ścieżki edukacyjnej SQL Academy, a Twój postęp synchronizuje się między webem a aplikacją CoddyKit. Kurs SQL Academy zawiera 4 lekcji w sumie.
Typowe zapytanie dotyczące szeregów czasowych
„Najnowsze dane dla jednej jednostki”:
SELECT * FROM metrics
WHERE device_id = 42
AND ts >= NOW() - INTERVAL '24 hours'
ORDER BY ts DESC LIMIT 1000;Indeks złożony (device_id, ts DESC)
Standardowy indeks dla szeregów czasowych:
CREATE INDEX metrics_device_ts_idx
ON metrics (device_id, ts DESC);
-- Equality on device_id, range + sort on ts: index handles both.Dlaczego kolejność ma znaczenie
- (device_id, ts) — najlepszy dla zapytań „dane tego urządzenia z ostatniego okresu”
- (ts, device_id) — najlepszy dla zapytań „dane ze wskazanego czasu dla wszystkich urządzeń”
Należy dobrać indeks do zestawu zapytań.
BRIN dla tabel tylko z dopisywanymi danymi
BRIN zajmuje bardzo mało miejsca — kilka MB dla tabeli zawierającej miliard wierszy. Jest skuteczny tylko wtedy, gdy dane są fizycznie posortowane według indeksowanej kolumny (co zwykle ma miejsce w przypadku szeregów czasowych):
CREATE INDEX metrics_ts_brin ON metrics USING BRIN (ts);
-- Excellent for "give me last 24 hours" on append-only tables.B-tree a BRIN
- B-tree — wyszukiwanie dokładnego identyfikatora w milisekundach; wyszukiwanie danych z ostatniego okresu
- BRIN — szybkie skanowanie zakresów dla danych monotonicznych; tani w utrzymaniu
Można je połączyć: B-tree dla (device_id), BRIN dla (ts).
Indeksy hypertabel
TimescaleDB propaguje indeksy do wszystkich fragmentów. Należy usuwać nieużywane indeksy — ich utrzymanie kosztuje dla każdego fragmentu.
Indeksy częściowe dla często używanych podzbiorów
Jeśli 99% zapytań dotyczy najnowszych danych:
CREATE INDEX metrics_recent_idx
ON metrics (device_id, ts DESC)
WHERE ts >= NOW() - INTERVAL '7 days';
-- Issue: predicate must use literal date or be re-created periodically.Unikanie funkcji na indeksowanej kolumnie
Nie należy stosować funkcji do indeksowanej kolumny — uniemożliwia to użycie indeksu:
-- BAD:
WHERE date_trunc('hour', ts) = $1
-- GOOD:
WHERE ts >= $1 AND ts < $1 + INTERVAL '1 hour'Indeks dla zapytań o najnowszy wiersz
W przypadku zapytania o „najnowszy odczyt dla każdego urządzenia” właściwy indeks zmienia zapytanie w skanowanie zakresu indeksu:
CREATE INDEX metrics_device_ts_idx ON metrics (device_id, ts DESC);
SELECT DISTINCT ON (device_id) device_id, ts, value
FROM metrics
ORDER BY device_id, ts DESC;
-- Uses the index to take the first row per device.Klastrowanie według najczęściej używanej kolejności
CLUSTER fizycznie zmienia kolejność tabeli zgodnie z indeksem. Jest to operacja jednorazowa; nowe dane nadal są dopisywane w kolejności napływania:
CLUSTER metrics USING metrics_device_ts_idx;
-- Cluster is heavy. TimescaleDB chunks help by keeping recent chunks small.Indeks haszujący dla równości o dużej liczbie różnych wartości
Rzadko używa się go w przypadku szeregów czasowych, ale jest dostępny. Zwykle wystarcza B-tree dla device_id.
Nie twórz zbyt wielu indeksów
Tabele szeregów czasowych są intensywnie obciążone operacjami zapisu. Każdy indeks oznacza dodatkowe operacje zapisu. Należy dodawać tylko te indeksy, których wymagają zapytania.
Podsumowanie
Indeksowanie szeregów czasowych opiera się na kilku wzorcach.
- Indeks złożony (entity, ts DESC) dla zapytań dotyczących poszczególnych jednostek
- BRIN dla ts w zapytaniach zakresowych dotyczących danych tylko dopisywanych
- Hypertabele: indeksy są propagowane do fragmentów
- Należy unikać predykatów stosujących funkcję do kolumny
Szybkie sprawdzenie
Najczęściej wykonywane zapytanie dotyczące szeregów czasowych filtruje dane według device_id i odczytuje dane z ostatnich 24 godzin. Jaki indeks będzie najlepszy?
Często zadawane pytania
Czy lekcja „Dobór indeksów dla szeregów czasowych” jest bezpłatna?
Tak — pełny tekst „Dobór indeksów dla szeregów czasowych” jest dostępny za darmo tutaj w sieci. Aby ćwiczyć ją interaktywnie (wbudowany edytor kodu i tutor AI dostępny 24/7) i odblokować resztę kursu SQL Academy, przejdź na CoddyKit PRO. Kurs SQL Academy zawiera 4 lekcji w sumie.
Co nauczysz się w „Dobór indeksów dla szeregów czasowych”?
Wybierać właściwe indeksy dla obciążeń szeregów czasowych — indeks złożony (device_id, ts DESC) obsługuje typowy wzorzec Ćwiczysz SQL Academy z praktycznym kodem, który uruchamiasz bezpośrednio w przeglądarce, a tutor AI dostępny 24/7 odpowiada na Twoje pytania podczas pracy nad lekcją.
Czy potrzebuję doświadczenia, aby zacząć SQL Academy?
Nie wymagamy żadnego doświadczenia. SQL Academy w CoddyKit jest strukturyzowany dla początkujących i zaawansowanych użytkowników, więc możesz zacząć tutaj lub od początku i uczyć się w swoim tempie. To lekcja 4 z 4.
Ile czasu zajmuje lekcja „Dobór indeksów dla szeregów czasowych”?
Większość lekcji CoddyKit trwa około 5–10 minut. Każda lekcja to mały, interaktywny krok, dzięki czemu robisz systematyczne postępy i zawsze wracasz dokładnie do tego samego miejsca — na webie i w aplikacji.
Czy mogę pisać i uruchamiać kod w tej lekcji SQL Academy?
Tak. Każda lekcja SQL Academy zawiera wbudowany edytor kodu, więc piszesz i uruchamiasz prawdziwy kod bezpośrednio w przeglądarce i od razu otrzymujesz sprzężenie zwrotne od AI — bez konfiguracji na komputerze.
Wszystkie lekcje w tym kursie
- Hypertabele TimescaleDB
- Agregaty ciągłe
- Zasady kompresji i retencji
- Dobór indeksów dla szeregów czasowych