Hardware e risorse
CPU, RAM, storage, temperature, stato dei dischi, alimentatori e ventole. Identificazione precoce di guasti hardware imminenti.
Sorveglianza continua della tua infrastruttura con rilevamento in tempo reale di anomalie, alert personalizzati e report analitici. Rackone monitora i tuoi server e cluster Proxmox 24 ore su 24, 365 giorni all'anno, insieme ai siti e ai servizi che pubblichi su internet, con un team tecnico certificato pronto a intervenire.
Il monitoraggio identifica le criticità quando sono ancora anomalie gestibili
È la raccolta continua di metriche da hardware, sistema operativo, macchine virtuali e servizi di rete, con soglie che generano un alert quando un valore esce dai parametri attesi. Serve a intercettare un disco che sta per cedere, una partizione che si riempie o un nodo che perde il quorum prima che diventino un fermo macchina. Su infrastrutture Proxmox VE il monitoraggio copre anche stato del cluster, repliche, job di backup e salute di Ceph.
Un guasto non rilevato in tempo costa ore di downtime, interventi in emergenza e potenziale perdita di dati. Il monitoraggio proattivo inverte questa dinamica: identifica le criticità quando sono ancora anomalie gestibili, non quando diventano interruzioni di servizio. Il risultato è un'infrastruttura più stabile, costi di intervento ridotti e una continuità operativa misurabile.
Il servizio copre l'intera infrastruttura, dall'hardware fisico ai singoli container, con monitoraggio costante e alert configurati in base alle tue esigenze operative. Alla sorveglianza dall'interno si affianca il controllo dall'esterno dei servizi che pubblichi su internet, descritto più avanti in questa pagina.
CPU, RAM, storage, temperature, stato dei dischi, alimentatori e ventole. Identificazione precoce di guasti hardware imminenti.
Stato del cluster, quorum, Corosync, servizi HA, replica storage e Ceph health. Visibilità completa sull'infrastruttura di virtualizzazione.
Stato, performance e disponibilità di ogni macchina virtuale e container LXC. Consumo risorse, I/O disco e traffico di rete per singola VM.
Stato delle interfacce, throughput, latenza, packet loss. Monitoraggio di bridge, VLAN e bonding configurati nel cluster.
Stato dei job di backup, esito degli ultimi run, spazio residuo sugli storage e stato di salute dei pool Ceph.
Soglie configurabili per ogni metrica. Notifiche immediate via email, SMS o canali dedicati. Escalation automatica in base alla criticità dell'evento.
Il servizio è disponibile in due configurazioni per adattarsi alla complessità della tua infrastruttura. Entrambi sono attivabili come servizio standalone o come complemento ai nostri piani di supporto Proxmox.
Sorveglianza continua dell'hardware, delle risorse di sistema e dei servizi Proxmox. Ideale per ambienti che necessitano di una copertura di base con alert tempestivi.
Copertura completa fino al livello delle singole VM e container, con dashboard dedicata e analisi delle tendenze. Per chi vuole la massima visibilità sulla propria infrastruttura.
Il monitoraggio è ancora più efficace quando è abbinato a un piano di supporto con SLA definiti: il nostro team non si limita a notificarti l'anomalia, ma interviene direttamente per risolverla. Il Monitoring Standard è incluso nel nostro piano di supporto di livello più alto. Per tutti gli altri piani, il monitoring può essere aggiunto come servizio complementare.
360 Monitoring
Un server può essere in perfetta salute e il servizio essere comunque irraggiungibile per chi lo usa. Un record DNS modificato, un certificato scaduto, una regola di firewall troppo stretta o un problema sulla rete del provider non producono alcun allarme sulle metriche interne, eppure fermano il sito o la posta esattamente come un guasto hardware. Per questo alla sorveglianza dall'interno affianchiamo il controllo dall'esterno, che verifica se i servizi pubblicati rispondono davvero dal punto di vista di chi li raggiunge da internet.
Per questa parte del servizio Rackone utilizza 360 Monitoring, la piattaforma di uptime e performance monitoring che rivendiamo e gestiamo per i nostri clienti. I controlli partono da 26 nodi distribuiti nel mondo, con frequenza fino a 60 secondi, e permettono di distinguere un disservizio reale da un problema di rete locale: se l'errore lo segnala un solo nodo la causa è quasi sempre di routing, se lo segnalano tutti il servizio è effettivamente fermo.
I livelli si distinguono per l'ampiezza del perimetro monitorato e per i controlli aggiuntivi. La frequenza di verifica a 60 secondi e la copertura dai 26 nodi internazionali restano identiche su tutti: cambia quanto si monitora, non la qualità con cui lo si fa.
Ogni livello può essere ampliato con monitor e server aggiuntivi acquistati singolarmente, senza dover passare al piano superiore. Il servizio viene erogato e gestito da Rackone: configuriamo i controlli, le soglie e i destinatari degli alert, e la piattaforma resta sotto la nostra amministrazione. Se hai già un piano di supporto attivo, gli alert dei servizi pubblicati confluiscono nello stesso canale di presa in carico.
Configuriamo il monitoraggio sulla tua infrastruttura senza interrompere le operazioni. Il setup comprende l'installazione degli agenti, la configurazione delle soglie di allerta e la verifica della connettività con la nostra piattaforma di sorveglianza. Non prevede downtime.
La piattaforma raccoglie metriche in tempo reale da ogni componente dell'infrastruttura. Quando una metrica supera la soglia configurata, il sistema genera un alert classificato per criticità, informativo, warning o critico, e lo invia ai destinatari configurati. L'obiettivo è darti il tempo di intervenire prima che un'anomalia diventi un'interruzione.
Oltre al rilevamento in tempo reale, il servizio produce report periodici con l'analisi delle tendenze: consumo risorse nel tempo, andamento dello storage, performance delle VM. Questo permette di identificare in anticipo le criticità emergenti, un disco che si sta riempiendo, un nodo che si avvicina al limite di RAM, un pool Ceph che perde performance, e pianificare gli interventi prima che diventino urgenze.
Il valore del monitoraggio sta nelle soglie, non nel numero di grafici. Queste sono le metriche che nella nostra esperienza anticipano davvero i guasti.
Stato SMART dei dischi, errori di lettura e scrittura, temperatura, stato di alimentatori e ventole, salute dei volumi RAID e dei pool ZFS. Un disco che inizia a rimappare settori si segnala giorni prima di rompersi.
Carico CPU, memoria disponibile, occupazione delle partizioni, spazio residuo sui datastore. Il riempimento di uno storage è la causa più banale e più frequente di fermo su cluster in produzione.
Stato del quorum, raggiungibilità dei nodi, latenza di Corosync, stato di Ceph con OSD e PG, ritardo delle repliche ZFS tra nodi.
Stato di accensione, risorse assegnate rispetto a quelle realmente usate, servizi applicativi esposti, tempi di risposta.
Esito dei job, durata, dimensione, ultimo backup andato a buon fine per ogni guest. Un backup che fallisce in silenzio si scopre il giorno del ripristino, quando è tardi.
Stato delle interfacce e dei bond, saturazione della banda, perdita di pacchetti, raggiungibilità dei servizi pubblicati e scadenza dei certificati.
Raggiungibilità di siti, portali e caselle di posta verificata dall'esterno, codice di risposta, tempo di caricamento, validità dei certificati e presenza degli indirizzi IP nelle blocklist. Sono i controlli che misurano il servizio come lo vede il cliente finale, non come lo vede il server.
Il monitoraggio è più efficace quando è integrato con servizi di gestione proattiva dell'infrastruttura.
Upgrade e tuning periodico programmato della tua infrastruttura Proxmox. Mantiene l'ambiente aggiornato, performante e allineato alle best practice.
Diagnosi approfondita di un cluster Proxmox esistente: configurazione, performance, sicurezza, aderenza alle best practice. Utile dopo una migrazione, prima di un ampliamento o come assessment periodico.
Intervento immediato per emergenze critiche sull'infrastruttura Proxmox o Ceph. Disponibile H24.
Sono tre cose diverse e vengono spesso confuse in fase di preventivo. Il monitoraggio osserva e avvisa: rileva l'anomalia e la notifica a chi di dovere. L'assistenza sistemistica interviene su richiesta, quando il problema si è già manifestato. Il supporto con SLA garantisce un tempo di presa in carico e di risoluzione contrattuale, con un team che interviene al posto tuo.
Il monitoraggio da solo ha senso se hai un team IT interno che riceve gli alert e sa cosa farne. Se invece vuoi che qualcuno intervenga, il monitoraggio va abbinato a un piano di supporto o all'assistenza sistemistica: è la combinazione che riduce davvero il downtime, perché accorcia sia il tempo di rilevamento sia il tempo di intervento.
Il monitoraggio è ottimizzato per ambienti Proxmox VE (cluster, nodi, VM, container, Ceph) ma può coprire anche server standalone Linux e Windows e infrastrutture miste. Contattaci per una valutazione del tuo ambiente.
Il Monitoring Standard monitora hardware e servizi di sistema. L'Advanced aggiunge il monitoraggio di VM, container e storage Ceph, la dashboard in tempo reale, gli alert multicanale e l'analisi delle tendenze. La scelta dipende dalla complessità dell'infrastruttura e dal livello di visibilità richiesto.
No, l'attivazione del monitoraggio non richiede downtime: l'installazione degli agenti e la configurazione delle soglie avvengono senza interrompere i servizi in produzione.
Dipende dalla configurazione del servizio. Con il solo monitoraggio, gli alert vengono inviati al tuo team IT. Se hai un piano di supporto attivo con SLA, il nostro team tecnico certificato può intervenire direttamente entro i tempi previsti dal piano.
Sì. Il monitoraggio è disponibile standalone o come complemento ai piani di supporto Proxmox. Nel piano di livello più alto il Monitoring Standard è già incluso.
Le metriche di sistema vengono campionate a intervalli di pochi minuti, quelle critiche come raggiungibilità dei nodi e stato dei servizi con frequenza più alta. La cadenza viene tarata in fase di attivazione: un campionamento troppo fitto genera rumore e falsi allarmi, uno troppo rado fa perdere gli eventi brevi.
Gli alert vengono inviati secondo le regole di notifica concordate, che valgono 24 ore su 24. Con il solo monitoraggio la notifica arriva al tuo team di reperibilità. Se il monitoraggio è abbinato a un piano di supporto con SLA, la presa in carico è nostra anche fuori orario, nei limiti previsti dal piano scelto.
Nella maggior parte dei casi sì, ed è un componente leggero che raccoglie le metriche locali. Dove non è possibile installarlo, il monitoraggio avviene tramite protocolli standard come SNMP, API della piattaforma e controlli di raggiungibilità dall'esterno. L'installazione non richiede riavvio dei servizi.
Solo metriche tecniche e di stato: carichi, spazi occupati, esiti dei job, disponibilità dei servizi. Non vengono raccolti i contenuti delle macchine virtuali né i dati applicativi. Le modalità di raccolta e conservazione vengono formalizzate nel contratto di servizio.
Sì. Il controllo di raggiungibilità avviene dall'esterno e non richiede accesso al server: basta l'indirizzo pubblico del servizio. Possiamo quindi monitorare siti, portali e caselle di posta ospitati presso altri provider, anche dove l'infrastruttura non è gestita da noi.
Il monitoraggio dei server guarda dall'interno e risponde alla domanda «come sta la macchina». Quello dei servizi pubblicati guarda dall'esterno e risponde alla domanda «il servizio è raggiungibile». Servono entrambi, perché un server sano può ospitare un sito irraggiungibile per un problema di DNS, di certificato o di rete, e un servizio che risponde può girare su una macchina che sta per esaurire lo spazio disco.
Un server di posta viene verificato con controlli TCP sulle porte dei protocolli in uso, SMTP, IMAP e POP3, nelle varianti in chiaro e cifrate.
Il costo del monitoraggio dipende dal numero di nodi e di guest da monitorare, dal livello scelto e dall'eventuale abbinamento a un piano di supporto. L'offerta viene costruita sulla dimensione reale dell'infrastruttura dopo una breve analisi: è l'unico modo per non pagare controlli che non servono.
Contattaci per un'offerta personalizzata in base alla dimensione e alla complessità del tuo ambiente.
0421 1885889 · [email protected]