Droga na produkcję
Jak commit staje się działającym wydaniem i co się dzieje, kiedy trzeba je cofnąć.
- Ręczne kroki i kto może je ominąć
- Rollback — sprawdzony czy tylko zakładany
- Rozjazd między środowiskami
- Sekrety w pipeline’ach
Przechodzę drogę, którą Twój kod trafia na produkcję, klastry, na których działa, rachunek, który generuje, i to, co widać, kiedy coś się psuje. Dostajesz listę tego, co naprawdę pilne, koszt każdego wariantu na trzy lata i plan, który zrealizujesz sam — albo ze mną.
Zwykle 1–2 tygodnie. Zakres i cena zależą od wielkości środowiska, więc ustalamy je po pierwszej rozmowie.
Cztery obszary — te same, w których pracuję jako konsultant. Czytane razem, bo problemy zwykle też są powiązane.
Jak commit staje się działającym wydaniem i co się dzieje, kiedy trzeba je cofnąć.
Czy klastry są przewidywalne — i czy bazy danych na nich przetrwają zły dzień.
Rachunek przeczytany pozycja po pozycji, żeby każde euro miało właściciela i powód.
Czy metryki, logi i ślady odpowiadają na pytanie, które masz w trakcie awarii — i kogo to budzi.
Każde ustalenie z dowodem, ułożone według bezpieczeństwa, niezawodności i kosztów.
Każda poprawka z nakładem i kosztem na trzy lata — łącznie z „zostawmy to”.
Najpierw szybkie wygrane, potem większe projekty, w kolejności, którą zespół udźwignie.
Spotkanie z zespołem: przechodzimy przez raport, zadajecie pytania, ustalamy kolejne kroki.
Analiza broni się sama. Jeśli chcesz pomocy przy poprawkach, zwykle prowadzi do takiej pracy.
Każde środowisko opisane w Git i promowane przez pull request.
ArgoCD · HelmJeden pipeline od commita do produkcji: wersjonowany, powtarzalny, łatwy do cofnięcia.
GitHub Actions · Azure DevOpsModuły Terraform, Terragrunt per środowisko i kontrola dryfu, która mówi, kiedy rzeczywistość się rozjeżdża.
Terraform · TerragruntKlastry CloudNativePG z przełączaniem awaryjnym, kopiami w magazynie obiektowym i odtwarzaniem do punktu w czasie.
CloudNativePGMetryki, logi i ślady w jednym miejscu, z pulpitami i alertami, dla których warto wstać.
Prometheus · Loki · Tempo · Grafana30 minut rozmowy, potem dostęp tylko do odczytu: repozytoria, klastry, rachunek za chmurę, pulpity.
Zwykle 1–2 tygodnie. Czytam pipeline’y, klastry, rachunek i telemetrię — i pytam zespół, co boli.
Ustalenia, wycenione warianty i plan, omówione z zespołem.
Naprawiacie sami, ze mną albo razem — plan działa w każdym wariancie.
Napisz, na czym pracujecie i co wciąż się sypie. Wrócę z zakresem analizy — bez zobowiązań.