Blog Tecnológico

Blog everyWAN

Tecnología, ciberseguridad y tendencias IT que importan

Análisis Profundo
Ciberseguridad
Tendencias IT
Filtrar por:
Servidores de rack idénticos apilados en un carro metálico, pendientes de montar, delante de un rack a medio poblar
8 min lectura

Corosync suma 650 milisegundos por cada nodo: el reloj que tu clúster actualizado sigue arrastrando

El tiempo que tarda un clúster Proxmox en rehacer la membresía tras perder un nodo no es fijo: crece 650 ms por cada nodo que añades, y con los valores de fábrica un clúster de 29 nodos llega a 45,21 segundos, justo donde la propia documentación pide corregirlo antes de que el watchdog de 60 segundos reinicie nodos sanos. Proxmox VE 9.2 lo bajó a 125 ms, pero solo al crear el clúster: los actualizados de la 8 a la 9 siguen con el valor viejo.

Servidor de almacenamiento abierto en un rack con las bahías de discos a la vista y una unidad extraída de su carro
9 min lectura

En Ceph la capacidad no la marca el clúster: la marca el disco más lleno

Un OSD por encima del 95 % detiene las escrituras de todo el clúster aunque «ceph df» siga enseñando decenas de teras libres. Los tres umbrales por defecto (0,85 / 0,90 / 0,95), por qué el mecanismo que repara se apaga cinco puntos antes que el que sirve, y la cuenta de capacidad con un nodo menos que casi nadie hace: con cuatro nodos el techo son 71 puntos, y 67 si quieres que la reconstrucción llegue a terminar.

Portal de un edificio antiguo con una única puerta acristalada, el portero automático y los buzones metálicos
8 min lectura

Tu proveedor de identidad no es una aplicación: es infraestructura

El lunes 24 de agosto, a las 03:38, empezó un ataque de denegación de servicio contra la plataforma digital compartida del Estado noruego. Cayeron diez servicios públicos y varios no tenían nada roto: se había atascado la puerta por la que se entra a todos. Digdir escribe en su página de estado que <code>eSignering</code> estaba inaccesible «a causa de las limitaciones en ID-porten», y también que las soluciones estaban «estables con las limitaciones que se han puesto» — parte de la caída la pusieron los propios defensores. Por qué el inicio de sesión único sigue siendo la decisión correcta, qué cambia cuando la puerta pasa a ser infraestructura y las tres preguntas que la reclasifican.

Pulsador de parada de emergencia en una pared: el nodo que se apaga a sí mismo para que el clúster pueda seguir
7 min lectura

La HA de Proxmox no evita la caída: la acorta (y a veces la provoca)

La propia documentación de Proxmox VE pone el techo: unos 2 minutos de detección y failover, y de ahí no se pasa del 99,999 %. Qué ocurre de verdad cuando muere un nodo (arranque en frío, no migración en vivo), por qué un nodo sano se reinicia solo a los 60 segundos de perder el quórum, los requisitos que se salta todo el mundo y cuándo no montamos HA.

Suscríbete a nuestra newsletter

Para recibir historias del mundo IT, novedades de everyWAN y ofertas exclusivas para suscriptores, date de alta a nuestra lista de correo

everyWAN
everyWAN