Infrastrutture

Progettiamo e gestiamo storage distribuito con Ceph. La certificazione è rilasciata da Red Hat, e in Italia siamo fra i pochi ad averla.

Cos’è Ceph

Un sistema di storage che distribuisce i dati su più macchine invece di tenerli su un apparato solo. Se un disco o un intero nodo si guastano, i dati restano accessibili e il sistema si ripara da sé. Cresce aggiungendo macchine, senza fermare nulla.

Tipo
Storage distribuito, senza punto singolo di guasto
Blocchi
RBD — dischi per macchine virtuali e container
File
CephFS — filesystem condiviso, montabile da più macchine
Oggetti
RGW — object storage compatibile con S3 e Swift
Crescita
Si aggiungono nodi a caldo, senza fermi
Ridondanza
Repliche o erasure coding, configurabili
Integrazione
Nativa in Proxmox VE, e anche su cluster a sé
Licenza
LGPL — software libero

Un solo storage, molti modi di usarlo

Volumi a blocchi (RBD) per macchine virtuali e container.

Ceph parla a vSphere via iSCSI o NFS: cambia lo storage, resta l’hypervisor.

Amazon S3

Compatibile con S3 e Swift: object storage on premise, i dati restano in azienda.

Kubernetes

Storage persistente via CSI, che sopravvive al riavvio di un pod o di un nodo.

Object Lock

Copie immutabili che il ransomware non può cifrare, nemmeno con le credenziali di amministratore. Funziona con Veeam.

CephFS

Un filesystem che si monta da più macchine insieme, senza un server NFS a fare da collo di bottiglia.

Snapshot

Istantanee di volumi e filesystem, e cloni che ripartono da quelle.

Replica remota

I dati stanno in più sedi contemporaneamente: se una cade, sono già altrove.

Archivi

Da qualche TB a decine di petabyte, aggiungendo nodi a caldo senza fermare nulla.

Commodity hardware

Gira su macchine ordinarie, anche su server che il produttore non supporta più.

Come si può costruire

Iperconvergente

Nodo 1VMDischiNodo 2VMDischiNodo 3VMDischi

Le stesse macchine fanno virtualizzazione e storage, dentro un unico cluster Proxmox VE. Meno hardware da comprare, da alimentare e da gestire.

Cluster dedicato

Host 1VMHost 2VMHost 3VMNodo 1DischiNodo 2DischiNodo 3Dischi

Ceph su macchine sue, separate dal calcolo, anche su hardware bare metal. Serve quando lo storage deve crescere per conto suo, servire più cluster, o reggere carichi che disturberebbero le macchine virtuali.

Con interfaccia SAN

Client 1iSCSIClient 2SMBClient 3NFSNodo 1CephNodo 2CephNodo 3Ceph

Quando i sistemi che useranno lo storage parlano iSCSI, SMB o NFS — server Windows, apparati che si aspettano una SAN classica — si può usare PetaSAN, di cui siamo distributori per l’Italia. È Ceph: stesso motore, stessi dati distribuiti, con sopra i protocolli che quei sistemi conoscono.

Anche su storage che non abbiamo installato noi

È il caso più frequente. Non serve che ci raccontiate com’è stato messo su né perché: quello lo guardiamo noi. Capita spesso di essere chiamati su installazioni fatte da qualcuno che nel frattempo non c’è più.

Contattaci

Cosa facciamo

Progettazione

Quanti nodi, quanti dischi, che rete. Il dimensionamento decide se il cluster reggerà quando un nodo cade: è la parte dove si sbaglia più spesso, e si scopre tardi.

Messa in opera

Installazione, configurazione delle regole di replica, integrazione con la virtualizzazione, prove di guasto prima di andare in produzione.

Manutenzione e aggiornamenti

Aggiornamenti di versione, sostituzione dei dischi, riequilibrio dei dati, espansione con nuovi nodi. Un cluster Ceph va seguito, non installato e dimenticato.

Recupero da disastro

Cluster degradato, prestazioni crollate, dati che non tornano, aggiornamento andato male. Interveniamo anche su installazioni fatte da altri.

Emergenze

Se lo storage è fermo e non risponde, si interviene subito. È il momento in cui serve qualcuno che l’abbia già visto succedere.

Formiamo chi lo gestirà

Due livelli, dall’architettura alla diagnosi quando qualcosa va storto. In aula, da voi o online, con la certificazione Red Hat alle spalle.

Corso Ceph

Le nostre competenze

  • Ceph in produzione
  • Partner PetaSAN — vedi la scheda sul sito PetaSAN
  • Red Hat Certified Specialist — Ceph Cloud Storage

Quando conviene

Ceph ha senso da tre nodi in su, quando i dati non possono fermarsi e la quantità cresce nel tempo. Sotto quella soglia esistono soluzioni più semplici, e ve lo diciamo invece di vendervi uno storage che non vi serve.

Domande che ci fanno

Intervenite anche su storage installati da altri?

Sì, ed è il caso più frequente. Non serve che l’abbiamo costruito noi: guardiamo com’è fatto, vi diciamo cosa vediamo e da lì decidete voi. Capita spesso di essere chiamati su cluster montati da qualcun altro che nel frattempo non c’è più.

Migrate uno storage esistente su Ceph?

Sì. Si fa a servizio acceso, spostando i dati un pezzo alla volta: le macchine virtuali continuano a lavorare mentre il trasferimento va avanti. Il fermo, quando serve, si riduce alla commutazione finale e si concorda con voi.

Da quanti nodi conviene partire?

Tre è il minimo perché il cluster regga la perdita di un nodo senza fermarsi. Si può iniziare da lì e aggiungerne altri quando servono, senza rifare niente. Sotto i tre nodi Ceph non ha senso, e ve lo diciamo invece di vendervelo lo stesso.

Serve hardware particolare?

Non c’è una lista di modelli approvati: Ceph gira su hardware standard, e non siete vincolati a un fornitore. Ci sono però caratteristiche che servono davvero — una rete dedicata e veloce, dischi pensati per lavorare sempre — perché sono quelle che determinano se il cluster va bene tutti i giorni. Non è questione di marca, è questione di come è fatto: lo verifichiamo insieme prima che compriate qualcosa.

Cosa succede se un nodo si guasta?

Niente che dobbiate fare voi nell’immediato. I dati sono su più nodi, quindi le macchine virtuali continuano a lavorare e il cluster si ricostruisce da solo le copie mancanti. Il nodo va sostituito con calma, nei tempi vostri, non di notte.

Avete uno storage da progettare, o uno che non va, o siete in emergenza?

Raccontateci la situazione: quanti dati, quanti nodi, cosa vi preoccupa. Diamo un parere prima di qualsiasi preventivo.

Se il cluster è fermo adesso, per le emergenze su Ceph abbiamo un servizio dedicato, ceph-support.eu: stesso team, un canale fatto apposta per rispondere in fretta.

Contattaci