Классы хранилищ и политики жизненного цикла
Сравните S3 Standard, Intelligent-Tiering, Glacier Instant Retrieval и Deep Archive и автоматизируйте переходы с помощью правил жизненного цикла.
«Классы хранилищ и политики жизненного цикла» — бесплатный урок Cloud & IT Cert Prep на CoddyKit. Это урок 4 из 4. Ты можешь прочитать весь урок бесплатно ниже — а потом практиковать его прямо в браузере с встроенным редактором кода и ИИ-репетитором 24/7. Это часть пути обучения Cloud & IT Cert Prep, и твой прогресс синхронизируется между веб-версией и приложением CoddyKit. Курс Cloud & IT Cert Prep содержит 4 уроков всего.
Зачем нужны классы хранения S3
Не ко всем данным обращаются с одинаковой частотой. Видеофайл, загруженный сегодня, может быть просмотрен тысячи раз в течение первой недели, а затем почти не использоваться после месяца. Классы хранения S3 позволяют сопоставить стоимость хранения с характером доступа: часто используемые данные хранятся в более дорогом классе, оптимизированном для быстрой Retrieval, а архивные данные — в очень дешёвых классах с большей задержкой Retrieval. На экзамене SAA-C03 регулярно встречаются задания на выбор подходящего класса для описанного характера доступа.
S3 Standard: класс по умолчанию
S3 Standard — это универсальный класс хранения по умолчанию: SLA доступности 99,99%, надёжность 11 девяток, отсутствие минимального срока хранения и платы за Retrieval. Данные хранятся как минимум в трёх AZ. Используйте Standard для часто используемых данных: веб-ресурсов, активных наборов данных и часто загружаемого содержимого. У Standard самая высокая стоимость хранения за GB, но нет платы за Retrieval, поэтому этот класс идеально подходит, если характер доступа неизвестен или данные используются несколько раз в месяц.
# Upload with explicit storage class
aws s3 cp file.dat s3://my-bucket/ --storage-class STANDARDS3 Intelligent-Tiering
S3 Intelligent-Tiering автоматически перемещает объекты между уровнями доступа в зависимости от изменения характера доступа, не влияя на производительность и не взимая плату за Retrieval. Он включает до четырёх уровней: Frequent Access (та же производительность, что и у Standard), Infrequent Access (объекты, к которым не обращались 30 дней, автоматически перемещаются сюда; экономия составляет около 40%), Archive Instant Access (90 дней без доступа; ещё около 50% экономии) и необязательный Deep Archive Access (180 дней). За каждый объект взимается небольшая ежемесячная плата за мониторинг и автоматизацию. Этот класс лучше всего подходит для данных с неизвестным или меняющимся характером доступа.
aws s3 cp file.dat s3://my-bucket/ --storage-class INTELLIGENT_TIERINGS3 Standard-IA и One Zone-IA
S3 Standard-Infrequent Access (Standard-IA) предназначен для данных, к которым обращаются реже одного раза в месяц: стоимость хранения ниже, чем у Standard, но взимается плата за Retrieval каждого GB и хранение минимум в течение 30 дней. Данные хранятся в нескольких AZ, обеспечивая ту же надёжность в 11 девяток. S3 One Zone-IA хранит данные только в одной AZ — это примерно на 20% дешевле, чем Standard-IA, но при отказе AZ данные будут потеряны. Используйте One Zone-IA только для данных, которые можно восстановить заново, или данных, уже реплицированных в другом месте (например, миниатюр, созданных из оригиналов, хранящихся в Standard).
aws s3 cp backup.tar.gz s3://my-bucket/ --storage-class STANDARD_IA
aws s3 cp thumbnail.jpg s3://my-bucket/ --storage-class ONEZONE_IAS3 Glacier Instant Retrieval
S3 Glacier Instant Retrieval предназначен для архивных данных, к которым обращаются редко (раз в квартал), но которые при обращении необходимо получать за миллисекунды. Стоимость хранения значительно ниже, чем у Standard-IA, однако плата за Retrieval выше. Минимальный срок хранения составляет 90 дней. Главное отличие от других классов Glacier — мгновенный доступ: данные извлекаются за миллисекунды, как в Standard, поэтому этот класс идеально подходит для архивов медицинских изображений или медиаресурсов, которые редко нужны, но должны быть немедленно доступны.
aws s3 cp quarterly-report.pdf s3://archive-bucket/ --storage-class GLACIER_IRS3 Glacier Flexible Retrieval
S3 Glacier Flexible Retrieval (ранее S3 Glacier) предлагает три уровня скорости Retrieval для архивных данных: Expedited (1–5 минут, более высокая стоимость), Standard (3–5 часов, умеренная стоимость) и Bulk (5–12 часов, минимальная стоимость). Минимальный срок хранения составляет 90 дней. Этот класс лучше всего подходит для резервных архивов, редко извлекаемых данных для соблюдения нормативных требований и цифрового хранения, когда задержка Retrieval в несколько часов приемлема. На экзамене его часто предлагают как решение, если в условии упоминаются «архивы, к которым обращаются несколько раз в год».
# Initiate a retrieval job from Glacier Flexible Retrieval
aws s3api restore-object \
--bucket my-archive-bucket \
--key old-backup.tar.gz \
--restore-request '{"Days":5,"GlacierJobParameters":{"Tier":"Standard"}}'S3 Glacier Deep Archive
S3 Glacier Deep Archive — самый дешёвый класс хранения S3, его стоимость составляет примерно 1 $/TB в месяц. Он предназначен для данных, которые хранятся 7–10 лет и к которым обращаются один или два раза в год. Время Retrieval составляет 12 часов для уровня Standard и 48 часов для уровня Bulk. Минимальный срок хранения — 180 дней. Варианты использования: архивы для соблюдения нормативных требований (HIPAA, SEC Rule 17a-4), архивирование цифровых медиа, геномные данные и долгосрочные исследовательские данные. Deep Archive дешевле локального хранения на магнитной ленте, при этом полностью управляется AWS и доступен удалённо.
aws s3 cp 2016-financial-archive.zip s3://deep-archive-bucket/ \
--storage-class DEEP_ARCHIVEПолитики жизненного цикла S3
Политики жизненного цикла S3 автоматизируют перемещение объектов между классами хранения и удаление объектов на основе заданных Вами правил. Политика жизненного цикла представляет собой документ JSON, прикреплённый к бакету; её правила указывают: фильтр (по префиксу, тегу или размеру объекта), действие перемещения (переместить объект в более дешёвый класс через N дней) и/или действие удаления (удалить через M дней). Правила жизненного цикла устраняют необходимость в пользовательских скриптах для управления уровнями хранения и удалением объектов в больших масштабах.
# Apply a lifecycle policy
aws s3api put-bucket-lifecycle-configuration \
--bucket my-data-bucket \
--lifecycle-configuration file://lifecycle.jsonПример политики жизненного цикла
Типичный жизненный цикл распределения уровней для файлов журналов: первые 30 дней объекты хранятся в S3 Standard (часто используются для отладки), затем автоматически перемещаются в Standard-IA на дни 31–90 (запрашиваются время от времени), затем — в Glacier Flexible Retrieval на дни 91–365 (удержание для соблюдения нормативных требований) и наконец удаляются через 365 дней (политика хранения выполнена). Это единственное правило жизненного цикла заменяет сложное задание cron и работает в любом масштабе без дополнительных административных затрат.
{
'Rules': [{
'ID': 'log-tiering',
'Status': 'Enabled',
'Filter': {'Prefix': 'logs/'},
'Transitions': [
{'Days': 30, 'StorageClass': 'STANDARD_IA'},
{'Days': 90, 'StorageClass': 'GLACIER'}
],
'Expiration': {'Days': 365}
}]
}Анализ классов хранения S3
Анализ классов хранения S3 отслеживает характер доступа к данным в бакете и формирует рекомендации о том, когда перемещать объекты в Standard-IA. После 30 дней наблюдения он создаёт отчёт, который можно просмотреть в консоли или экспортировать в файл CSV в S3; в отчёте показана частота чтения в зависимости от возраста объекта. Используйте эти отчёты для настройки порогов перемещения в политике жизненного цикла перед их установкой. Анализ классов хранения интегрируется с S3 Intelligent-Tiering: результаты анализа можно использовать для настройки точной политики жизненного цикла или просто перейти на Intelligent-Tiering.
Сравнение классов хранения: краткая памятка
Краткое руководство по выбору класса хранения: Standard → активные, часто используемые данные; Intelligent-Tiering → неизвестный или изменчивый характер доступа; Standard-IA → нечастый доступ (ежемесячно), несколько AZ; One Zone-IA → нечастый доступ, данные, которые можно восстановить заново, одна AZ; Glacier Instant Retrieval → редкий доступ (ежеквартально), Retrieval за миллисекунды; Glacier Flexible Retrieval → редкий доступ, Retrieval за несколько часов допустим; Glacier Deep Archive → хранение в течение 7–10 лет, Retrieval за 12–48 часов. За минимальные сроки хранения (30, 30, 90, 90, 180 дней) взимается плата при досрочном удалении.
Быстрая проверка
Проверьте своё понимание концепций AWS Solutions Architect (SAA-C03) из этого урока.
Итоги урока
В этом уроке Вы узнали, что классы хранения S3 охватывают диапазон от Standard (частый доступ, самая высокая стоимость) до Glacier Deep Archive (нечастый доступ, самая низкая стоимость), и у каждого класса есть определённые сроки Retrieval и минимальные сроки хранения, S3 Intelligent-Tiering автоматизирует распределение по уровням при неизвестном характере доступа, а политики жизненного цикла автоматизируют перемещение между классами и удаление объектов на основе их возраста или тегов. Далее мы рассмотрим архитектуру VPC и блоки CIDR.
Часто задаваемые вопросы
Урок «Классы хранилищ и политики жизненного цикла» бесплатный?
Да — полный текст урока «Классы хранилищ и политики жизненного цикла» бесплатно доступен здесь в веб-версии. Чтобы практиковать его интерактивно (встроенный редактор кода и ИИ-репетитор 24/7) и разблокировать остальной курс Cloud & IT Cert Prep, подпишись на CoddyKit PRO. Курс Cloud & IT Cert Prep содержит 4 уроков всего.
Чему я научусь в уроке «Классы хранилищ и политики жизненного цикла»?
Сравните S3 Standard, Intelligent-Tiering, Glacier Instant Retrieval и Deep Archive и автоматизируйте переходы с помощью правил жизненного цикла. Ты практикуешь Cloud & IT Cert Prep с помощью реального кода, который запускаешь прямо в браузере, и ИИ-репетитор 24/7 отвечает на твои вопросы во время урока.
Нужен ли мне опыт, чтобы начать Cloud & IT Cert Prep?
Предыдущий опыт не требуется. Cloud & IT Cert Prep на CoddyKit структурирован для всех уровней — от новичков до продвинутых, поэтому ты можешь начать отсюда или с самого начала и учиться в своем темпе. Это урок 4 из 4.
Сколько времени занимает урок «Классы хранилищ и политики жизненного цикла»?
Большинство уроков CoddyKit занимают около 5–10 минут. Каждый из них компактный и интерактивный, поэтому ты постоянно делаешь прогресс и продолжаешь с того же места в веб-версии и приложении.
Можно ли писать и запускать код в этом уроке Cloud & IT Cert Prep?
Да. Каждый урок Cloud & IT Cert Prep включает встроенный редактор кода, поэтому ты пишешь и запускаешь реальный код прямо в браузере и получаешь моментальную обратную связь от AI — локальная установка не требуется.
Все уроки этого курса
- Контейнеры, объекты и регионы
- Управление доступом S3: политики контейнеров и ACL
- Версионирование, MFA Delete и репликация
- Классы хранилищ и политики жизненного цикла