El portal de empleo de España
Ingeniero de Confiabilidad de Sitios Sénior
En remoto, Madrid·Jornada completa·Añadida hace 22 días
16 ofertas abiertas
Resumen
Detalles del puesto
Jornada completa
Según la oferta.
Totalmente en remoto
Solo desde ciertos lugares, según la oferta: «Fully remote EU timezone (CET ±2h)»
Requisitos
Trabajar en inglés
Se requiere inglés, según la oferta.
Tener experiencia de nivel sénior
Puesto de nivel Senior.
Esta oferta se ha traducido automáticamente al español.
Salario y beneficios
Qué ofrecen
Trabajo 100% remoto con horario flexible
Rol de alto impacto con autonomía y responsabilidad
Equipo de ingeniería internacional y colaborativo
Stack tecnológico de vanguardia con un fuerte enfoque en la fiabilidad y la automatización.
Requisitos
Qué buscan
Experiencia práctica a nivel experto operando Kubernetes en entornos de producción.
Sólidas habilidades de ingeniería de redes (VLANs, enrutamiento L2/L3, VPNs, conectividad multi-sitio); esto es esencial para el puesto.
Gran competencia en la administración de sistemas Linux (Debian/Ubuntu).
Sólido conocimiento de los fundamentos de redes y capacidad para diseñar arquitecturas de red complejas.
Experiencia construyendo y manteniendo flujos de trabajo de automatización (Ansible, Bash/Python, basados en Git).
Experiencia con stacks de observabilidad como Prometheus, Grafana, ELK, Loki o Graylog.
Experiencia con tecnologías de virtualización (OpenStack, Proxmox, VMware).
Experiencia con aprovisionamiento bare-metal y MAAS (Metal as a Service).
Sólido conocimiento de sistemas distribuidos y orquestación de contenedores.
Mentalidad orientada a procesos con capacidad para desarrollar SOPs y procedimientos operativos desde cero.
Experiencia con respuesta ante incidentes, procedimientos de escalada y rotaciones de guardia.
Capacidad para trabajar de forma autónoma en un entorno dinámico orientado a la ingeniería.
Sólidas habilidades técnicas combinadas con alineación con los valores del equipo.
Se valorará
Experiencia con service mesh (Istio, Linkerd) o implementaciones avanzadas de CNI.
Conocimiento de APIs de Cloudflare, automatización de DNS o configuraciones de túneles.
Experiencia con infraestructura de GPU, preparación de nodos o planificación de recursos.
Familiaridad con las mejores prácticas de seguridad (RBAC, firewalls, políticas de red).
Experiencia en gestión de activos de TI o flujos de trabajo de seguimiento de licencias.
Experiencia trabajando en entornos de múltiples zonas horarias y coordinando equipos distribuidos.
Experiencia estableciendo prácticas de fiabilidad y marcos de trabajo SRE en organizaciones en crecimiento.
El puesto
En Pragmatike estamos contratando para ampliar nuestro equipo e impulsar el crecimiento de nuestros proyectos internos.
Nuestro enfoque se centra en el desarrollo de soluciones de vanguardia en Cloud Computing, fomentando al mismo tiempo una cultura de colaboración e innovación. Unirte a nosotros significa formar parte de un equipo apasionado donde tus ideas y habilidades contribuyen directamente a dar forma a las tecnologías del mañana.
Si te entusiasma trabajar en proyectos ambiciosos en un entorno dinámico y flexible, ¡nos encantaría saber de ti!
Qué harás
Operar y mantener infraestructura basada en Linux (Debian/Ubuntu).
Desplegar, gestionar y escalar clústeres de Kubernetes en entornos bare-metal, virtualizados y on-prem.
Supervisar el ciclo de vida completo del clúster: actualizaciones, node pools, redes, almacenamiento y endurecimiento de la seguridad (security hardening).
Implementar la automatización para el aprovisionamiento y las operaciones utilizando Ansible, Bash/Python y flujos de trabajo GitOps.
Diseñar y mantener la arquitectura de red, incluyendo VLANs, enrutamiento L2/L3, VPNs y conectividad multi-sitio.
Construir flujos de trabajo de despliegue automatizado (PXE boot, Preseed, cloud-init).
Desplegar y mantener stacks de observabilidad (Prometheus/Grafana, Loki, ELK, Graylog).
Liderar la respuesta ante incidentes y las actividades de escalada en toda la plataforma.
Mejorar la disponibilidad del sistema y reducir la latencia en todos los niveles.
Definir e implementar SLOs/SLIs en múltiples niveles de infraestructura (red física/hardware, virtualización de plataforma, servicios de software).
Optimizar los flujos de alertas y monitorización para proporcionar información procesable (actionable insights).
Establecer y mantener turnos de guardia (on-call) para garantizar la cobertura en diferentes zonas horarias.
Desarrollar Procedimientos Operativos Estándar (SOPs) para tareas de operación y mantenimiento repetibles.
Coordinar el mantenimiento físico de Policlouds (mantenimiento periódico, problemas de hardware, DC-Ops).
Gestionar las capas de virtualización y orquestación (OpenStack, Proxmox, VMware).
Ayudar a desarrollar y mantener la arquitectura general de todos los productos.
Planificar recursos para futuras iniciativas, teniendo en cuenta la demanda y las proyecciones de crecimiento.
Trabajar con los equipos de desarrollo para mejorar la calidad general y optimizar la utilización de recursos.
Colaborar con partes interesadas de diversas áreas (equipos de Hivenet, Policloud y Customer Success).
Cómo trabajarás
Ubicación: Totalmente remoto, zona horaria de la UE (CET ±2h)
Fecha de inicio: Lo antes posible
Idiomas: Inglés fluido obligatorio
Sector: Cloud Computing
Sobre Pragmatike
Pragmatike es una empresa de servicios y consultoría de TI especializada en computación en la nube, ingeniería de datos y operaciones de aprendizaje automático (MLOps). La empresa ayuda a las empresas a construir y escalar su infraestructura de datos e IA, con un fuerte enfoque en Kubernetes, arquitecturas nativas de la nube y cargas de trabajo de IA basadas en GPU. Pragmatike opera como una organización remota-first, sirviendo a clientes principalmente en la región EMEA.
Pragmatike tiene una presencia significativa en España, con su sede en Madrid y un equipo de ingenieros trabajando de forma remota en todo el país. La empresa es muy relevante para profesionales internacionales dado su modelo de contratación totalmente remoto, que permite a los ingenieros trabajar desde cualquier lugar de España o de la región EMEA en general. Sus puestos abiertos en España, como Principal ML Ops Engineer y AI Infrastructure Engineer, son muy adecuados para talento internacional que busque unirse a una consultoría de nube e IA especializada y de rápido crecimiento.
- Sector
- IT Services
- Fundación
- 2021
- Plantilla
- 50–200
- Sede
- Madrid, Spain
- En España
- Madrid
Datos prácticos
- Roles 100% remotos en EMEA: no se requiere reubicación a una oficina específica
- El proceso de contratación se realiza en inglés, lo que lo hace accesible para candidatos internacionales
- Enfoque en el stack moderno de nube e IA (Kubernetes, GPU, MLOps): muy relevante para ingenieros provenientes de grandes tecnológicas o startups
- Nómina y contrato en España a través de un EOR (Employer of Record) local para contrataciones internacionales
- Equipo pequeño y ágil (alrededor de 50 personas): los ingenieros tienen exposición directa a clientes y decisiones de arquitectura




