Shanraq.org Shanraq.org
Healthchecks, лимиты и корректная остановка
IT

Cloud & DevOps: от локального приложения до надёжного сервиса Урок 12 из 24

Healthchecks, лимиты и корректная остановка

Различаем liveness и readiness, задаём ресурсные границы и проверяем поведение при остановке.

Текст переведён с помощью ИИ.

Этот урок начинается с нуля. Незнакомое слово здесь не считается вашим пробелом: мы сначала создадим образ, затем дадим точное значение и только потом применим его.

Где мы находимся

Полётное повторение. В прошлом уроке была опора services + network + volumes = один повторяемый запуск. Не подглядывая, назовите её четыре звена и только затем сравните с записью.

Результат урока

Различаем liveness и readiness, задаём ресурсные границы и проверяем поведение при остановке. Не переходите дальше, пока не можете объяснить, что проверяет каждая команда и какой отказ она обнаруживает.

Сначала знакомый образ

В больнице пульс отвечает, жив ли человек, но не говорит, готов ли хирург начать операцию. А расписание операционной ограничивает число одновременных операций. Так же liveness, readiness и resource limits отвечают на три разные задачи; смешивать их опасно.

Аналогия помогает начать рассуждение, но не заменяет устройство технологии. Ниже мы уточним каждое слово.

Опорный сигнал урока

liveness: перезапустить? | readiness: дать трафик? | limits: сколько можно?

Прочитайте цепочку слева направо. Она отвечает не на вопрос «какую команду запомнить», а на вопрос «почему следующий шаг следует из предыдущего».

Новые слова простыми словами

  • Liveness — Проверка: завис ли процесс настолько, что его следует перезапустить?
  • Readiness — Проверка: следует ли сейчас направлять сюда запросы?
  • Resource limit — Верхняя граница CPU или памяти для процесса.
  • Graceful shutdown — Остановка с прекращением нового трафика и завершением начатой работы.

Разбираем без спешки

Liveness отвечает, нужно ли перезапустить процесс; readiness — можно ли направлять ему новый трафик. Ошибка в этой границе превращает временно занятой сервис в цикл перезапусков. Лимиты защищают соседей, но слишком низкий лимит сам создаёт отказ.

Сейчас не нужно запоминать формулировку дословно. Найдите в ней причинную связь и привяжите её к опорному сигналу выше.

Сначала предскажите результат

До запуска ответьте на бумаге: что должно измениться, что должно остаться прежним и какой вывод команды подтвердит ваш прогноз? Даже неверный прогноз полезен, если после опыта вы можете объяснить расхождение.

Опыт маленькими шагами

Выполните команды из корня course/cloud-devops-lab. Команды рассчитаны на учебную среду. Перед командой, меняющей сервер или данные, прочитайте её целиком и проверьте текущий каталог. Запускайте блок по одной смысловой группе. После каждой остановитесь и сопоставьте результат со своим прогнозом.

docker compose ps
docker inspect --format '{{json .State.Health}}' cloud-devops-lab-app-1 2>/dev/null || true
time docker compose stop -t 10 app
docker compose up -d app
curl -fsS http://127.0.0.1:8080/readyz

Эталонные файлы проекта.

Что именно делает этот опыт

Упражнение наблюдает оба endpoint, затем посылает SIGTERM и проверяет завершение. Смотрите не только на код команды: спросите, перестал ли сервис принимать новую работу и успел ли закончить старую.

Что должно получиться

  • Остановка укладывается в grace period.
  • Команда завершается предсказуемым кодом.
  • Результат можно повторить на чистой среде.

Соберите целое по опорной схеме

Опорная схема 12

Проведите пальцем или карандашом по четырём блокам и расскажите весь урок одним связным объяснением.

Воспроизведите без подсказки

  1. Закройте схему и нарисуйте четыре блока по памяти.
  2. Объясните каждый переход словами «потому что».
  3. Дайте определение одному новому термину, не повторяя текст дословно.
  4. Назовите один сигнал, который доказывает результат.

Найдите и исправьте ошибку

Ошибка: «Чем чаще и глубже liveness-проверка, тем надёжнее». Исправление: тяжёлая или неверная проверка сама создаёт перезапуски и аварию.

Задание

Теперь соберите тот же смысл самостоятельно. Можно смотреть на опорную схему; цель — не экзамен на память, а воспроизводимый результат.

Обязательное. Напишите POSIX sh-цикл с дедлайном, который ждёт readiness URL, делает паузу между попытками и возвращает ненулевой код после таймаута. Отправьте только команды или скрипт POSIX sh без реальных ключей и токенов.

Критерии готовности

  • Вы понимаете каждую запускаемую строку.
  • Повторный запуск даёт ожидаемый результат или безопасно объяснённое отличие.
  • В выводе нет настоящих ключей, токенов и паролей.
  • Вы можете показать факт, который подтверждает успех.

Если проверка не прошла, зафиксируйте ожидаемое и фактическое, вернитесь к одному разорванному звену опоры и повторите. Ошибка не отнимает у вас право продолжать обучение.

По желанию. Запишите один возможный отказ и сигнал, по которому вы его заметите.

Открытая перспектива

Следующий урок добавит новую опору: Registry, immutable tags, SBOM и проверка цепочки поставки.

Оглавление курса

Если вы нашли ошибку или опечатку в тексте статьи, то сообщите нам об этом

Проверить задание

Сначала решите и запустите в VS Code — редактор покажет ошибку на месте. Готовое решение вставьте сюда. Проверяет модель: она укажет на ошибку, но не даст готовый ответ.

Чтобы проверить, нужно войти. Войти

Комментарии (0)

Пока нет комментариев. Будьте первым.