El portal de empleo de España
Ingeniero de Fiabilidad de Sitios Sénior / Kubernetes
En remoto, Madrid·Jornada completa·Añadida hace 22 días
16 ofertas abiertas
Resumen
Detalles del puesto
Jornada completa
Según la oferta.
Totalmente en remoto
Solo desde ciertos lugares, según la oferta: «Fully remote EU timezone (CET ±2h)»
Requisitos
Trabajar en inglés
Se requiere inglés, según la oferta.
Tener experiencia de nivel sénior
Puesto de nivel Senior.
Esta oferta se ha traducido automáticamente al español.
Salario y beneficios
Qué ofrecen
Trabajo 100% remoto con horario flexible
Rol de alto impacto con autonomía y responsabilidad
Equipo de ingeniería internacional y colaborativo
Stack tecnológico de vanguardia con un fuerte enfoque en la fiabilidad y la automatización.
Requisitos
Qué buscan
Experiencia práctica de nivel experto operando Kubernetes en entornos de producción.
Sólidas habilidades de ingeniería de redes (VLANs, enrutamiento L2/L3, VPNs, conectividad multi-sitio); esto es esencial para el puesto.
Gran competencia en la administración de sistemas Linux (Debian/Ubuntu).
Sólido conocimiento de los fundamentos de redes y capacidad para diseñar arquitecturas de red complejas.
Experiencia en la creación y el mantenimiento de flujos de trabajo de automatización (Ansible, Bash/Python, basados en Git).
Experiencia con stacks de observabilidad como Prometheus, Grafana, ELK, Loki o Graylog.
Experiencia con tecnologías de virtualización (OpenStack, Proxmox, VMware).
Experiencia con aprovisionamiento bare-metal y MAAS (Metal as a Service).
Sólido conocimiento de sistemas distribuidos y orquestación de contenedores.
Mentalidad orientada a procesos con capacidad para desarrollar SOPs y procedimientos operativos desde cero.
Experiencia con respuesta ante incidentes, procedimientos de escalada y rotaciones de guardia.
Capacidad para trabajar de forma autónoma en un entorno dinámico orientado a la ingeniería.
Sólidas habilidades técnicas combinadas con alineación con los valores del equipo.
Se valorará
Experiencia con service mesh (Istio, Linkerd) o implementaciones avanzadas de CNI.
Conocimiento de APIs de Cloudflare, automatización de DNS o configuraciones de túneles.
Experiencia con infraestructura de GPU, preparación de nodos o planificación de recursos.
Familiaridad con las mejores prácticas de seguridad (RBAC, firewalls, políticas de red).
Experiencia en la gestión de activos de TI o flujos de trabajo de seguimiento de licencias.
Experiencia trabajando en entornos de múltiples zonas horarias y coordinando equipos distribuidos.
Experiencia estableciendo prácticas de fiabilidad y marcos de trabajo SRE en organizaciones en crecimiento.
El puesto
Ubicación: Totalmente remoto, zona horaria de la UE (CET ±2h)
Fecha de inicio: Lo antes posible
Idiomas: Inglés fluido obligatorio
Sector: Cloud Computing
En Pragmatike estamos contratando para ampliar nuestro equipo e impulsar el crecimiento de nuestros proyectos internos.
Nuestro enfoque es el desarrollo de soluciones de vanguardia en Cloud Computing, fomentando al mismo tiempo una cultura de colaboración e innovación. Unirte a nosotros significa formar parte de un equipo apasionado donde tus ideas y habilidades contribuyen directamente a dar forma a las tecnologías del mañana.
Si te entusiasma trabajar en proyectos ambiciosos en un entorno dinámico y flexible, ¡nos encantaría saber de ti!
Qué harás
Operar y mantener infraestructura basada en Linux (Debian/Ubuntu).
Desplegar, gestionar y escalar clústeres de Kubernetes en entornos bare-metal, virtualizados y on-prem.
Supervisar el ciclo de vida completo del clúster: actualizaciones, node pools, redes, almacenamiento y endurecimiento de la seguridad (security hardening).
Implementar la automatización para el aprovisionamiento y las operaciones utilizando Ansible, Bash/Python y flujos de trabajo GitOps.
Diseñar y mantener la arquitectura de red, incluyendo VLANs, enrutamiento L2/L3, VPNs y conectividad multi-sitio.
Crear flujos de trabajo de despliegue automatizado (PXE boot, Preseed, cloud-init).
Desplegar y mantener stacks de observabilidad (Prometheus/Grafana, Loki, ELK, Graylog).
Liderar la respuesta ante incidentes y las actividades de escalada en toda la plataforma.
Mejorar la disponibilidad del sistema y reducir la latencia en todos los niveles.
Definir e implementar SLOs/SLIs en múltiples niveles de infraestructura (red física/hardware, virtualización de plataforma, servicios de software).
Optimizar los flujos de alertas y monitorización para proporcionar información procesable (actionable insights).
Establecer y mantener turnos de guardia (on-call) para garantizar la cobertura en diferentes zonas horarias.
Desarrollar Procedimientos Operativos Estándar (SOPs) para tareas de operación y mantenimiento repetibles.
Coordinar el mantenimiento físico de Policlouds (mantenimiento periódico, problemas de hardware, DC-Ops).
Gestionar las capas de virtualización y orquestación (OpenStack, Proxmox, VMware).
Ayudar a desarrollar y mantener la arquitectura general de todos los productos.
Planificar recursos para futuras iniciativas, teniendo en cuenta la demanda y las proyecciones de crecimiento.
Trabajar con los equipos de desarrollo para mejorar la calidad general y optimizar la utilización de recursos.
Colaborar con partes interesadas transversales (equipos de Hivenet, Policloud, Customer Success).
Sobre Pragmatike
Pragmatike es una empresa de servicios y consultoría de TI especializada en computación en la nube, ingeniería de datos y operaciones de aprendizaje automático (MLOps). La empresa ayuda a las empresas a construir y escalar su infraestructura de datos e IA, con un fuerte enfoque en Kubernetes, arquitecturas nativas de la nube y cargas de trabajo de IA basadas en GPU. Pragmatike opera como una organización remota-first, sirviendo a clientes principalmente en la región EMEA.
Pragmatike tiene una presencia significativa en España, con su sede en Madrid y un equipo de ingenieros trabajando de forma remota en todo el país. La empresa es muy relevante para profesionales internacionales dado su modelo de contratación totalmente remoto, que permite a los ingenieros trabajar desde cualquier lugar de España o de la región EMEA en general. Sus puestos abiertos en España, como Principal ML Ops Engineer y AI Infrastructure Engineer, son muy adecuados para talento internacional que busque unirse a una consultoría de nube e IA especializada y de rápido crecimiento.
- Sector
- IT Services
- Fundación
- 2021
- Plantilla
- 50–200
- Sede
- Madrid, Spain
- En España
- Madrid
Datos prácticos
- Roles 100% remotos en EMEA: no se requiere reubicación a una oficina específica
- El proceso de contratación se realiza en inglés, lo que lo hace accesible para candidatos internacionales
- Enfoque en el stack moderno de nube e IA (Kubernetes, GPU, MLOps): muy relevante para ingenieros provenientes de grandes tecnológicas o startups
- Nómina y contrato en España a través de un EOR (Employer of Record) local para contrataciones internacionales
- Equipo pequeño y ágil (alrededor de 50 personas): los ingenieros tienen exposición directa a clientes y decisiones de arquitectura




