Диагностика раздувания и стратегия очистки
Разберитесь, как MVCC создаёт раздувание таблиц и индексов, как его измерять и как настраивать автоматическую очистку для поддержания высокой производительности.
«Диагностика раздувания и стратегия очистки» — бесплатный урок Advanced PostgreSQL: Indexing, Partitioning, Replication на CoddyKit. Это урок 4 из 4. Ты можешь прочитать весь урок бесплатно ниже — а потом практиковать его прямо в браузере с встроенным редактором кода и ИИ-репетитором 24/7. Это часть пути обучения Advanced PostgreSQL: Indexing, Partitioning, Replication, и твой прогресс синхронизируется между веб-версией и приложением CoddyKit. Курс Advanced PostgreSQL: Indexing, Partitioning, Replication содержит 4 уроков всего.
Части этого урока еще не переведены и отображаются на английском.
MVCC and Dead Tuples
PostgreSQL uses MVCC: updates and deletes leave behind old row versions called dead tuples. Until they are cleaned up, they occupy space and slow scans. This wasted space is bloat.
What VACUUM Does
VACUUM reclaims dead tuples for reuse and updates visibility information. It usually does not return space to the OS; VACUUM FULL does but rewrites the whole table and takes a strong lock.
Measuring Bloat
Inspect dead tuple counts per table from the statistics view.
SELECT relname, n_live_tup, n_dead_tup,
last_autovacuum
FROM pg_stat_user_tables
ORDER BY n_dead_tup DESC;Autovacuum Basics
Autovacuum runs in the background, triggering when dead tuples exceed a threshold based on table size and the scale factor setting.
-- trigger ~ threshold + scale_factor * n_live_tup
autovacuum_vacuum_scale_factor = 0.2Tuning Hot Tables
For large, frequently updated tables, the default 20% scale factor is too lazy. Lower it per table so vacuum runs more often on less garbage.
ALTER TABLE orders SET (
autovacuum_vacuum_scale_factor = 0.02);Vacuum Throttling
Autovacuum throttles itself with cost limits to avoid I/O storms. On modern hardware you can raise autovacuum_vacuum_cost_limit so vacuum finishes faster.
autovacuum_vacuum_cost_limit = 2000Transaction ID Wraparound
VACUUM also prevents transaction ID wraparound, a catastrophic condition. Aggressive anti-wraparound vacuums are non-negotiable and cannot be skipped.
SELECT datname, age(datfrozenxid)
FROM pg_database ORDER BY 2 DESC;Index Bloat
Indexes bloat too. REINDEX CONCURRENTLY rebuilds an index without blocking writes, restoring its compactness.
REINDEX INDEX CONCURRENTLY orders_pkey;HOT Updates
Heap-Only Tuple updates avoid index churn when no indexed column changes. Leaving some free space via a lower fillfactor helps HOT updates and reduces bloat.
ALTER TABLE orders SET (fillfactor = 90);VACUUM vs ANALYZE
VACUUM reclaims space; ANALYZE refreshes the planner statistics. Autovacuum does both, but after big bulk loads run ANALYZE manually for fresh plans.
ANALYZE orders;A Monitoring Habit
Alert on rising n_dead_tup, growing table size with stable row counts, and high age(datfrozenxid). These early signals let you tune before queries slow down.
Quick Check
A large, hot table keeps growing despite stable row counts. What is the likely cause and fix?
Recap
You learned to diagnose bloat from MVCC dead tuples, measure it with pg_stat_user_tables, tune autovacuum per table, guard against ID wraparound, and use REINDEX CONCURRENTLY and fillfactor to keep performance high.
Изучай Advanced PostgreSQL: Indexing, Partitioning, Replication с ИИ-репетитором — бесплатно
Пиши и запускай код прямо в браузере, получай мгновенную помощь от ИИ-репетитора 24/7 и продолжи учиться на сайте или в приложении.
- Курсы
- 11
- Уроки
- 44
Часто задаваемые вопросы
Урок «Диагностика раздувания и стратегия очистки» бесплатный?
Да — полный текст урока «Диагностика раздувания и стратегия очистки» бесплатно доступен здесь в веб-версии. Чтобы практиковать его интерактивно (встроенный редактор кода и ИИ-репетитор 24/7) и разблокировать остальной курс Advanced PostgreSQL: Indexing, Partitioning, Replication, подпишись на CoddyKit PRO. Курс Advanced PostgreSQL: Indexing, Partitioning, Replication содержит 4 уроков всего.
Чему я научусь в уроке «Диагностика раздувания и стратегия очистки»?
Разберитесь, как MVCC создаёт раздувание таблиц и индексов, как его измерять и как настраивать автоматическую очистку для поддержания высокой производительности. Ты практикуешь Advanced PostgreSQL: Indexing, Partitioning, Replication с помощью реального кода, который запускаешь прямо в браузере, и ИИ-репетитор 24/7 отвечает на твои вопросы во время урока.
Нужен ли мне опыт, чтобы начать Advanced PostgreSQL: Indexing, Partitioning, Replication?
Предыдущий опыт не требуется. Advanced PostgreSQL: Indexing, Partitioning, Replication на CoddyKit структурирован для всех уровней — от новичков до продвинутых, поэтому ты можешь начать отсюда или с самого начала и учиться в своем темпе. Это урок 4 из 4.
Сколько времени занимает урок «Диагностика раздувания и стратегия очистки»?
Большинство уроков CoddyKit занимают около 5–10 минут. Каждый из них компактный и интерактивный, поэтому ты постоянно делаешь прогресс и продолжаешь с того же места в веб-версии и приложении.
Можно ли писать и запускать код в этом уроке Advanced PostgreSQL: Indexing, Partitioning, Replication?
Да. Каждый урок Advanced PostgreSQL: Indexing, Partitioning, Replication включает встроенный редактор кода, поэтому ты пишешь и запускаешь реальный код прямо в браузере и получаешь моментальную обратную связь от AI — локальная установка не требуется.
Все уроки этого курса
- Комплексная настройка производительности
- Расширенный мониторинг и оповещения
- Будущие тенденции PostgreSQL
- Диагностика раздувания и стратегия очистки