Administracja i utrzymanie Proxmox: Proxmox Care

Klaster po wdrożeniu żyje: aktualizacje, backupy, incydenty, rosnące zużycie zasobów. Bierzemy to na siebie. Prowadzimy wasz Proxmox tak, jak prowadzimy własny klaster produkcyjny, na którym działa hosting IQHost.

Wdrożenie to początek, nie koniec

Dzień odbioru wdrożenia to moment, w którym klaster jest w najlepszej formie w całym swoim życiu. Potem zaczyna się codzienność: wychodzą nowe wersje Proxmox VE i kernela, backupy czasem cicho przestają się kończyć sukcesem, dysk w macierzy Ceph zaczyna raportować błędy SMART, a maszyny przybywają szybciej, niż ktokolwiek planował. Jeśli nikt tego nie pilnuje, problemy kumulują się miesiącami i ujawniają w najgorszym momencie, zwykle przy awarii węzła.

Typowy scenariusz, który widzimy przy przejmowaniu środowisk: klaster nieaktualizowany od roku, bo "działa, to nie ruszamy", backupy skonfigurowane raz i nigdy nie testowane, brak alertingu poza mailem z PBS, który i tak trafia do spamu. To działa do pierwszego poważnego incydentu. Proxmox Care istnieje po to, żeby do niego nie doszło, a jeśli dojdzie, żeby ktoś kompetentny zareagował w gwarantowanym czasie.

Co obejmuje Proxmox Care

Monitoring 24/7 Prometheus i Grafana z alertingiem: stan węzłów i kworum, zdrowie Ceph/ZFS, zapełnienie storage, statusy backupów, certyfikaty, obciążenie. Alert trafia do nas, nie do waszej skrzynki.
Aktualizacje bez przestoju Rolling update: live migration maszyn z węzła, aktualizacja, powrót, kolejny węzeł. Usługi działają cały czas, a klaster nie odjeżdża wersjami od upstreamu.
Kontrola backupów i testowy restore Codzienna weryfikacja zadań backupu w PBS plus comiesięczny testowy restore wybranej maszyny. Backup, którego nikt nie odtworzył, to hipoteza, nie zabezpieczenie.
Patchowanie bezpieczeństwa Śledzimy CVE dotyczące Proxmox VE, kernela, QEMU i komponentów storage. Krytyczne łatki wdrażamy poza normalnym cyklem aktualizacji.
Reakcja na incydenty Gwarantowany czas reakcji zapisany w umowie. Awaria węzła, problem z kworum, degradacja Ceph, nieudany backup: diagnozujemy i naprawiamy, potem opisujemy przyczynę.
Raport miesięczny Co się działo w środowisku: wykonane aktualizacje, incydenty i ich przyczyny, wyniki testów restore, trendy zużycia zasobów. Konkret, nie generowany PDF z wykresami.
Przegląd pojemności Regularnie sprawdzamy trend zużycia RAM, CPU i storage względem pojemności klastra, z uwzględnieniem scenariusza N-1. Rozbudowę planujecie z wyprzedzeniem, nie pod presją.
Konsultacje Bieżące pytania waszego zespołu: jak wydzielić VLAN dla nowego projektu, LXC czy KVM, jak ustawić replikację. Krótsza droga niż forum i zgadywanie.

Pakiety i ceny

Wycena zależy od skali środowiska (liczba węzłów i maszyn, ZFS czy Ceph), okna wsparcia i wymaganego czasu reakcji. Ramowo:

Pakiet Cena netto / mies. Dla kogo
Podstawowy od 2 500 zł Mniejsze klastry, wsparcie i reakcja w godzinach roboczych, pełny monitoring i kontrola backupów
Rozszerzony od 5 000 zł Środowiska produkcyjne, krótszy czas reakcji, szersze okno wsparcia, więcej godzin konsultacji
SLA 24/7 12 000 do 30 000+ zł Środowiska krytyczne: całodobowy dyżur, najkrótsze czasy reakcji, priorytetowa obsługa incydentów

Szczegółowy zakres i konkretne czasy reakcji ustalamy po przeglądzie waszego środowiska. Ile kosztuje samo wdrożenie i jak liczyć całość, opisaliśmy w artykule ile kosztuje wdrożenie Proxmox.

Przejmujemy klastry po innych

Nie musimy być autorami wdrożenia, żeby wziąć za nie odpowiedzialność. Onboarding środowiska, którego nie znamy, wygląda tak:

Dla kogo jest Proxmox Care

Utrzymujemy własną produkcję. Na klastrach Proxmox z 8 węzłami (ponad 4 TB RAM) i dwóch serwerach Proxmox Backup Server z ponad 100 TB przestrzeni działa hosting IQHost: 8 044 aktywnych stron przy 99,94% uptime infrastruktury. Procedury, które sprzedajemy w Proxmox Care, to procedury, na których sami polegamy.

Częste pytania

Czy przejmujecie klastry wdrożone przez kogoś innego?

Tak, większość klientów Proxmox Care przychodzi do nas z działającym środowiskiem: po innym integratorze albo po samodzielnym wdrożeniu. Zaczynamy od health checku i inwentaryzacji, spisujemy plan naprawczy dla znalezionych problemów, przejmujemy dostępy i wpinamy monitoring. Po onboardingu bierzemy odpowiedzialność za środowisko na siebie.

Jak wygląda SLA i gwarantowany czas reakcji?

Zależy od pakietu. Podstawowy obejmuje reakcję w godzinach roboczych, wyższe pakiety skracają czas reakcji i rozszerzają okno wsparcia, aż do pełnego 24/7 z dyżurem dla środowisk krytycznych. Konkretne czasy reakcji i priorytety incydentów zapisujemy w umowie po przeglądzie środowiska, bo SLA bez znajomości architektury byłoby fikcją.

Czy do usługi utrzymania potrzebna jest subskrypcja Proxmox?

Nie jest wymagana. Proxmox VE działa w pełni bez subskrypcji, subskrypcja daje dostęp do enterprise repo i wsparcia producenta. Dla środowisk produkcyjnych zwykle rekomendujemy przynajmniej Community (120 EUR za socket CPU rocznie netto), bo enterprise repo dostaje pakiety po dłuższym okresie stabilizacji. Szczegóły poziomów opisaliśmy w artykule o subskrypcjach Proxmox.

Jak rozliczana jest usługa Proxmox Care?

Stały miesięczny abonament, faktura VAT. Wysokość zależy od liczby węzłów i maszyn, użytego storage (ZFS, Ceph), okna wsparcia i wymaganego SLA. Pakiety zaczynają się od 2 500 zł netto miesięcznie, środowiska krytyczne z SLA 24/7 to 12 000 do 30 000+ zł miesięcznie. Prace poza zakresem, na przykład rozbudowa klastra, wyceniamy osobno.

Oddajcie klaster w dobre ręce

Opiszcie nam swoje środowisko: liczba węzłów, storage, co was boli. Wrócimy z propozycją zakresu i wyceną. Jeśli wolicie zacząć od diagnozy, zamówcie health check, a jego koszt ma sens sam w sobie: dostaniecie raport z rekomendacjami niezależnie od tego, czy podpiszemy umowę na utrzymanie.

Zapytaj o Proxmox Care Zamów health check