SLA w usługach IT: co powinno znaleźć się w dobrej umowie?

SLA w usługach IT: co powinno znaleźć się w dobrej umowie?

Spis treści

1. Dlaczego SLA jest kluczowe w usługach IT

Czym jest SLA i jak różni się od SLO/OLA

SLA (Service Level Agreement) to umowa określająca minimalne parametry jakości usług IT oraz sposób ich mierzenia. SLO (Service Level Objective) to pojedynczy cel metryki, np. dostępność 99,9%. OLA (Operational Level Agreement) opisuje wewnętrzne uzgodnienia między zespołami dostawcy, które mają umożliwić dotrzymanie SLA. W skrócie: SLA = zobowiązanie wobec klienta, SLO = liczby, które trzeba osiągnąć, OLA = “kto i jak” po stronie dostawcy.

Gdzie daje największą wartość (MSP, chmura, helpdesk)

W środowisku MSP (outsourcing IT) SLA porządkuje odpowiedzialność i koszty – wiadomo, co jest w abonamencie, a co rozliczane osobno. W chmurze SLA pozwala porównywać dostawców na twardych metrykach dostępności i trwałości danych. W helpdesku SLA chroni biznesowe priorytety: krytyczne zgłoszenia mają gwarantowany czas reakcji i naprawy, aby minimalizować przestoje.

Najczęstsze ryzyka bez jasno zdefiniowanego SLA

  • Niedopasowane oczekiwania i spory o zakres wsparcia.
  • Brak priorytetów incydentów i chaos przy awariach.
  • Niemierzalne obietnice jakości, przez co trudno egzekwować poprawę.
  • Niejasne zasady rozliczeń i brak planu wyjścia z umowy.

2. Co powinno znaleźć się w dobrej umowie SLA

Zakres i definicje: usługi, wyłączenia, okna serwisowe

Umowa powinna precyzyjnie zdefiniować, jakie systemy i lokalizacje są objęte opieką, a także wyłączenia (np. sprzęt poza wsparciem producenta, modyfikacje klienta). Warto zapisać okna serwisowe, kiedy możliwe są planowane prace wymagające przerw.

Metryki i poziomy: dostępność, czas reakcji/naprawy, RPO/RTO

  • Dostępność: procent w skali miesiąca/kwartału, z wyszczególnieniem, co liczy się jako niedostępność.
  • Czas reakcji i czas naprawy: różne progi dla incydentów o odmiennych priorytetach.
  • RPO/RTO: cele odtworzeniowe dla backupu i planów ciągłości działania.

Klasyfikacja incydentów i zasady eskalacji

Zdefiniuj Priorytet 1–4 na podstawie wpływu na biznes i pilności. Opisz ścieżkę eskalacji: od serwisu pierwszej linii, przez inżyniera on-call, po menedżera kontraktu. Dodaj punkt o komunikacji statusów (np. aktualizacja co 30 minut przy P1).

Monitorowanie i raportowanie: źródła danych, “SLA clock”, strefy czasowe

Wskaż narzędzia monitoringu jako źródło prawdy i sposób liczenia “SLA clock” – od kiedy tyka czas reakcji i co go zatrzymuje (np. oczekiwanie na dostęp do serwera). Jeśli działacie w wielu strefach czasowych, zapisz, które godziny stanowią czas pracy i jak przeliczany jest support 24/7.

Bezpieczeństwo i zgodność: backup, DR, szyfrowanie, audyty, RODO/ISO

  • Cykle backupu, testy odtwarzania i minimalne retencje.
  • Plan Disaster Recovery z docelowym RTO/RPO i miejscem DR.
  • Szyfrowanie danych w spoczynku i w tranzycie, kontrola dostępu.
  • Audyty bezpieczeństwa, zgodność z RODO i normami (np. ISO 27001).

Odpowiedzialność i rozliczenia: kary/kredyty, limitacje, siła wyższa, plan wyjścia

Ustal mechanizm kredytów SLA lub kar umownych, limity odpowiedzialności oraz definicję siły wyższej. Dodaj plan wyjścia: migracja danych, przekazanie dokumentacji i okres wsparcia po rozwiązaniu umowy.

3. Wnioski i praktyczne wskazówki dla zamawiającego

Krótka checklista do negocjacji parametrów

  • Minimalne poziomy dla: dostępności, czasu reakcji, czasu naprawy.
  • Priorytety incydentów i okna serwisowe.
  • RPO/RTO, testy DR i polityka backupu.
  • Raportowanie KPI: częstotliwość, format, źródła danych.
  • Kary/kredyty, limity odpowiedzialności, plan wyjścia.

Weryfikacja SLA własnym monitoringiem i dowodami

Nie opieraj się wyłącznie na raportach dostawcy. Używaj własnego monitoringu syntetycznego i logów. Uzgodnij wspólne wskaźniki i metodologię liczenia awarii, aby spory skracać do minimum.

Procedura reklamacyjna i cykliczne przeglądy KPI

Zapisz, jak i w jakim terminie składa się reklamację oraz kto po obu stronach ją rozpatruje. Raz na kwartał organizuj przegląd KPI, ryzyk i planów rozwoju – to najlepszy moment na kalibrację SLO i priorytetów.

Zasada: mierz, raportuj, koryguj – zamiast mnożyć kary

Dobre SLA to narzędzie zarządzania usługą, nie tylko bat. Wspólne metryki, transparentny monitoring i szybka korekta procesów dają większą dostępność i mniejsze koszty niż same sankcje. Jeśli szukasz partnera, który rozumie praktykę SLA w outsourcingu, sprawdź outsourcing it poznań – jasno zdefiniowane parametry wsparcia to mniej ryzyka i przewidywalny budżet.