Usługi / FinOps

Koszt chmury

Chmura, której koszt ma właściciela

Grafana i tagi pokazują, który zespół wydaje. Kubernetes mówi, gdzie leży idle. Terraform trzyma rozmiar w kodzie. Pipeline nie zostawia preview na tydzień. Rightsizing, zobowiązania i anomalia mają rytm, bez ślepego lock-in.

Właściciel Każdy koszt ma tag i zespół
Rytm Tydzień, miesiąc, kwartał, bez jednorazowej akcji
Rightsize Pomiar użycia, potem zmiana typu
SLO Oszczędność, która nie psuje dostępności
Jak to składa się w całość

Widoczność, pojemność, kod, hygiene

Sama faktura nic nie zmienia. Składamy alokację, Kubernetes, Terraform i pipeline w rytm FinOps, który engineering utrzyma.

  • Dla fintechu oszczędność nie łamie kontroli i SLO. Tanie środowisko, które nie przeżyje audytu, jest najdroższe.
  • Zobowiązania chmury po kilku cyklach pomiaru, nie w pierwszym tygodniu.
Grafana, katalog dashboardów i źródeł danych
01, Widoczność

Rachunek w języku produktu, nie samej faktury

Alokacja per usługa, zespół, środowisko. Dashboard dla engineeringu i dla finansów. Anomalia dnia, nie zaskoczenie na koniec miesiąca. Bez tagów nie ma właściciela, więc najpierw porządek etykiet.

Tagi

Wymagane na koncie. Policy blokuje zasób bez właściciela.

Showback

Koszt per produkt. Chargeback gdy organizacja jest na to gotowa.

Anomalia

Alert na skok. Idle disk, logi bez retencji, martwy load balancer.

Rytm

Tydzień anomalii, miesiąc rightsizingu, kwartał zobowiązań.

Kubernetes Dashboard, pody, CPU i pamięć
02, Kubernetes

Requesty i node group, które odpowiadają ruchowi

Nadmiar requestów puchnie node pool. Brak limitów psuje sąsiadów. Widzimy idle, burstable i spot tam, gdzie SLO pozwala. To inżynierska dźwignia kosztu, nie rabat z cennika.

Rightsize

CPU i RAM poda vs użycie. Rekomendacja z pomiarem, nie z zgadywania.

Node

Typ instancji, autoscaler, spot dla batch. Produkcja ma osobną politykę.

Idle

Namespace po projekcie, preview bez TTL, martwy PVC.

SLO

Oszczędność, która psuje p95, wraca jako koszt incydentu.

Terraform Registry, providery i moduły infrastruktury
03, Terraform

Rozmiar i klasa storage w module, nie w konsoli

Registry i Wasze moduły trzymają domyślne typy instancji, lifecycle storage, backup. Zmiana rozmiaru idzie przez plan. Infracost albo równoważny widok w MR, gdy zespół jest na to gotowy.

Domyślne

Moduł nie stawia x2xlarge „na wszelki wypadek”.

Lifecycle

Dysk gp, archiwum, retencja logów. Polityka w kodzie.

Zobowiązania

RI i Savings Plans po pomiarze, nie na ślepo. Dokumentowany horyzont.

MR

Plan pokazuje delta zasobów. Koszt zmian jest częścią przeglądu.

GitLab, pipeline CI/CD, status i etapy build
04, Pipeline

Preview i runner nie zostają na fakturze

Środowisko z MR ma TTL. Artefakty i cache mają retencję. Runner autoskaluje. GitLab pokazuje, który projekt pali minuty. To najprostsza dźwignia, często pomijana.

TTL

Preview ginie po merge albo po N dniach. Alert gdy zostaje.

Artefakty

Obrazy, logi jobów, cache. Retencja i GC.

Minuty

Showback CI per zespół. Wspólny runner nie jest darmowy.

Produkcja

Pipeline nie ma prawa zostawić stacka „na test” bez tagu i właściciela.

Operacja

Od tagów do zobowiązań

Najpierw alokacja. Potem idle i rightsizing. Na końcu RI albo SP i rytm kwartalny.

Ilustracja FinOps, wykres kosztu chmury i tag na koncie
  1. Alokacja Tagi, showback, anomalia, właściciele.
  2. Quick wins Idle, retencja, preview TTL, oczywisty oversize.
  3. Architektura Storage class, node group, model ruchu.
  4. Zobowiązania RI, SP, committed use, przegląd kwartalny.
Rozmowa

Omówimy alokację, idle i rytm kosztu

Na tej podstawie przygotujemy zakres FinOps, od tagów do zobowiązań.

Skontaktuj się