Mostrando entradas con la etiqueta infraestructura. Mostrar todas las entradas
Mostrando entradas con la etiqueta infraestructura. Mostrar todas las entradas

lunes, mayo 02, 2016

Datacenter Tier-IV y 2N+1? Aclarando conceptos

Cuando presentas un Datacenter como un lugar para alojar datos críticos de empresa, la primera pregunta es siempre... ¿Qué certificación tiene?¿Es un tier-II, III o IV? La pregunta es lógica, ya que en el fondo, se quiere conocer su disponibilidad de servicio anual (Tier-III es de 99,982% o 3 nueves, mientras que un tier-IV es de 99,991% o 4 nueves). La disponibilidad tiene una componente que controlas, que el tiempo en el que un sistema no presta el servicio para el que se diseñó porque está "en mantenimiento". Este estado no forma parte de las características de un tier-III o IV, y es una de las diferencias fundamentales con los tier-I o II, no hay "maintenance downtime".  
Antes de seguir, es interesante conocer lo que implica añadir "nueves" al porcentaje de disponibilidad. Si "dos nueves" son 3 días, 15 horas, 40 minutos de interrupción anual, "tres nueves" (tier-III) son 8 horas, 46 minutos, "cuatro nueves" (tier-IV) son 52 minutos, 36 segundos, "cinco nueves" 5 minutos, 15 segundos o "seis nueves" tan sólo 32 segundos anuales de no disponibilidad.
Por otro lado, ¿Qué significa disponer de redundancia "N", "N+1", "2N+1", etc.? N es el número de elementos que proporcionan servicio y capacidad. Lo entenderemos mejor con un ejemplo: un almacén de helados. Ahí N sería el número de neveras en los que se almacenan cajas de helados. Tenemos 50 neveras de 20 cajas de capacidad, es decir, capacidad máxima = 1.000 cajas, y N = 50. Si se estropea una nevera, tendremos que trasladar las cajas a otra que no esté llena, pero si no tenemos espacio vacío (100% de capacidad), se estropearán. Así, introducimos en el almacén una nevera vacía como estrategia (N+1) ante esa eventualidad (nevera que falla). También podríamos disponer de toda la infraestructura redundada al 100% (2N), o incluso, la máxima redundancia, 2N+1. Como se ve, a mayor redundancia, más coste (más neveras) ya que hemos ido pasando de 50 neveras (N) a 51 (N+1), de ahí a 100 (2N) o 101 (2N+1). Evidentemente la ocupación es otra variable en el diseño de la disponibilidad del servicio, ya que la capacidad real la dará lo que estimemos prudente ocupar, si el 100% de la capacidad total o la que se diseñe..
Dicho esto, la clasificación de un Datacenter según el Uptime Institute es como sigue:

Características Tier I Tier II Tier III Tier IV
Redundancia N N+1 N+1 2N+1
Número líneas electricas 1 1 1 x Activo / 1 x Pasivo 2 Activas
Personal Permanente Ninguno 1 solo turno 1 por cada turno 24 x 7 x 365
Puntos únicos de fallo Muchos Muchos Algunos Sólo por incendio o fallo humano
Tolerancia a fallos no planificados No No No Si
Interrupción servicio por mantenimiento anual 2 de mas de 12 horas 1.5 de más de 12 horas 0 0
Interrupción anual de servicio 2 cortes de más de 4 horas 1 corte de más de 4 horas 0 cortes de más de 4 horas 0 cortes de más de 4 horas
Tiempo anual de servicio de mantenimiento 28.8 horas 22 horas 1.6 horas 0.8 horas
Disponibilidad del Servicio 99,671% 99,749% 99,982% 99,991%

jueves, julio 12, 2012

Algunos criterios a considerar en la elección de un proveedor de Cloud

Estamos en una época en la que los servicios CLOUD de infraestuctura de Datacenter aparecen como agua de mayo, para paliar la sequía de nuevos recursos que sufren los departamentos de TI de las compañias, con presupuestos congelados o muy reducidos, desde ya hace un tiempo. Y esta escasez se ha reducido substancialmente este año: Nada de CAPEX, todo a OPEX, y a hacer mucho más con menos...
En este entorno, aparecen múltiples proveedores de Cloud como proveedores de infraestructura, prometiendo ser la solución al problema. Sin embargo, es conveniente cuestionarse la oferta que realizan, y en este artículo sugiero algunas preguntas, sin ánimo de ser una lista cerrada, para realizarles o realizarse a uno mismo:
  1. ¿Dónde estarán los datos y los recursos contratados? La LOPD y la latencia de algunas aplicaciones pueden ser críticas, si la respuesta es "al otro lado del charco", o vaguedades tipo "y qué más da dónde estén".
  2. ¿Es posible construir nubes híbridas, aprovechando parte de mi infraestructura alojándola en otro CPD u otro de este proveedor? De nuevo... ¿Latencias entre puntos?
  3. Integración con nuestras comunicaciones actuales y la VPN corporativa.Tipos de circuitos que puedo contratar, y si son del proveedor o subcontratados a terceros...
  4. ¿Es posible disponer de algún tipo de infraestructura de recuperación de desastres, ubicada geográficamente a centenares de Kms de la principal? Es importante, los terremotos y desastres naturales son más frecuentes de lo que nos imaginamos (recordad Lorca o Bolonia), además de los sabotajes y otro tipo de incidentes que pueden afectar a la disponibilidad de los sistemas.
  5. ¿Es escalable la infraestructura contratada?¿Y "contraíble" para el caso de que tengamos que hacer un "downgrade" de los recursos?
  6. ¿Qué disponibilidad y SLAs de los recursos contratados tengo, para el caso de levantarlos en cualquier momento o para la disponibilidad de cuándo están levantados y funcionando?
  7. ¿Puedo tener "sorpresas" en mi factura por arrancar recursos que luego me puedo dejar funcionando?¿Existe algun sistema de alarmas o monitorización de los servicios contratados, con un panel de control fácil de utilizar?
  8. Estoy confiando mis datos a un proveedor externo. ¿Cuán fiable y estable, financiera y estratégicamente hablando, es dicho proveedor?¿Qué alianzas y certificaciones tiene que avalen los servicios Cloud que ofrece?
  9. ¿Qué experiencia tiene este proveedor gestionando infraestructuras críticas de terceros?
  10. ¿Qué conectividad a internet tiene este proveedor, en términos de peering y de "cercanía" al backbone de internet?
En fin, son muchas preguntas, y más que iré ampliando, a medida que lea y relea este artículo. ¿Qué pensáis vosotros?