SLA w usługach IT: co powinno znaleźć się w dobrej umowie?
SLA w usługach IT: co powinno znaleźć się w dobrej umowie?
Spis treści
1. Dlaczego SLA jest kluczowe w usługach IT
Czym jest SLA i jak różni się od SLO/OLA
SLA (Service Level Agreement) to umowa określająca minimalne parametry jakości usług IT oraz sposób ich mierzenia. SLO (Service Level Objective) to pojedynczy cel metryki, np. dostępność 99,9%. OLA (Operational Level Agreement) opisuje wewnętrzne uzgodnienia między zespołami dostawcy, które mają umożliwić dotrzymanie SLA. W skrócie: SLA = zobowiązanie wobec klienta, SLO = liczby, które trzeba osiągnąć, OLA = “kto i jak” po stronie dostawcy.
Gdzie daje największą wartość (MSP, chmura, helpdesk)
W środowisku MSP (outsourcing IT) SLA porządkuje odpowiedzialność i koszty – wiadomo, co jest w abonamencie, a co rozliczane osobno. W chmurze SLA pozwala porównywać dostawców na twardych metrykach dostępności i trwałości danych. W helpdesku SLA chroni biznesowe priorytety: krytyczne zgłoszenia mają gwarantowany czas reakcji i naprawy, aby minimalizować przestoje.
Najczęstsze ryzyka bez jasno zdefiniowanego SLA
- Niedopasowane oczekiwania i spory o zakres wsparcia.
- Brak priorytetów incydentów i chaos przy awariach.
- Niemierzalne obietnice jakości, przez co trudno egzekwować poprawę.
- Niejasne zasady rozliczeń i brak planu wyjścia z umowy.
2. Co powinno znaleźć się w dobrej umowie SLA
Zakres i definicje: usługi, wyłączenia, okna serwisowe
Umowa powinna precyzyjnie zdefiniować, jakie systemy i lokalizacje są objęte opieką, a także wyłączenia (np. sprzęt poza wsparciem producenta, modyfikacje klienta). Warto zapisać okna serwisowe, kiedy możliwe są planowane prace wymagające przerw.
Metryki i poziomy: dostępność, czas reakcji/naprawy, RPO/RTO
- Dostępność: procent w skali miesiąca/kwartału, z wyszczególnieniem, co liczy się jako niedostępność.
- Czas reakcji i czas naprawy: różne progi dla incydentów o odmiennych priorytetach.
- RPO/RTO: cele odtworzeniowe dla backupu i planów ciągłości działania.
Klasyfikacja incydentów i zasady eskalacji
Zdefiniuj Priorytet 1–4 na podstawie wpływu na biznes i pilności. Opisz ścieżkę eskalacji: od serwisu pierwszej linii, przez inżyniera on-call, po menedżera kontraktu. Dodaj punkt o komunikacji statusów (np. aktualizacja co 30 minut przy P1).
Monitorowanie i raportowanie: źródła danych, “SLA clock”, strefy czasowe
Wskaż narzędzia monitoringu jako źródło prawdy i sposób liczenia “SLA clock” – od kiedy tyka czas reakcji i co go zatrzymuje (np. oczekiwanie na dostęp do serwera). Jeśli działacie w wielu strefach czasowych, zapisz, które godziny stanowią czas pracy i jak przeliczany jest support 24/7.
Bezpieczeństwo i zgodność: backup, DR, szyfrowanie, audyty, RODO/ISO
- Cykle backupu, testy odtwarzania i minimalne retencje.
- Plan Disaster Recovery z docelowym RTO/RPO i miejscem DR.
- Szyfrowanie danych w spoczynku i w tranzycie, kontrola dostępu.
- Audyty bezpieczeństwa, zgodność z RODO i normami (np. ISO 27001).
Odpowiedzialność i rozliczenia: kary/kredyty, limitacje, siła wyższa, plan wyjścia
Ustal mechanizm kredytów SLA lub kar umownych, limity odpowiedzialności oraz definicję siły wyższej. Dodaj plan wyjścia: migracja danych, przekazanie dokumentacji i okres wsparcia po rozwiązaniu umowy.
3. Wnioski i praktyczne wskazówki dla zamawiającego
Krótka checklista do negocjacji parametrów
- Minimalne poziomy dla: dostępności, czasu reakcji, czasu naprawy.
- Priorytety incydentów i okna serwisowe.
- RPO/RTO, testy DR i polityka backupu.
- Raportowanie KPI: częstotliwość, format, źródła danych.
- Kary/kredyty, limity odpowiedzialności, plan wyjścia.
Weryfikacja SLA własnym monitoringiem i dowodami
Nie opieraj się wyłącznie na raportach dostawcy. Używaj własnego monitoringu syntetycznego i logów. Uzgodnij wspólne wskaźniki i metodologię liczenia awarii, aby spory skracać do minimum.
Procedura reklamacyjna i cykliczne przeglądy KPI
Zapisz, jak i w jakim terminie składa się reklamację oraz kto po obu stronach ją rozpatruje. Raz na kwartał organizuj przegląd KPI, ryzyk i planów rozwoju – to najlepszy moment na kalibrację SLO i priorytetów.
Zasada: mierz, raportuj, koryguj – zamiast mnożyć kary
Dobre SLA to narzędzie zarządzania usługą, nie tylko bat. Wspólne metryki, transparentny monitoring i szybka korekta procesów dają większą dostępność i mniejsze koszty niż same sankcje. Jeśli szukasz partnera, który rozumie praktykę SLA w outsourcingu, sprawdź outsourcing it poznań – jasno zdefiniowane parametry wsparcia to mniej ryzyka i przewidywalny budżet.