El portal de empleo de España

Ingeniero de Plataforma

En remoto, Madrid·Añadida hace 17 días

Cloudlinux

10 ofertas abiertas

Resumen

Detalles del puesto

  • Totalmente en remoto

    Según la oferta.

Requisitos

  • Trabajar en inglés

    Se requiere inglés, según la oferta.

  • Tener experiencia de nivel sénior

    Puesto de nivel Senior.

Esta oferta se ha traducido automáticamente al español.

Salario y beneficios

Qué ofrecen

  • Enfoque en el desarrollo profesional.
  • Proyectos interesantes y desafiantes.
  • Trabajo totalmente remoto con horario flexible, lo que te permite organizar tu día y trabajar desde cualquier lugar del mundo.
  • 24 días de vacaciones pagadas al año, 10 días de festivos nacionales y bajas por enfermedad ilimitadas.
  • Compensación para seguro médico privado.
  • Reembolso de coworking y gimnasio/deportes.
  • Presupuesto para formación.
  • La oportunidad de recibir una recompensa por la idea más innovadora que la empresa pueda patentar.

Requisitos

Qué buscan

  • Experiencia a nivel Senior en infraestructura, plataforma o ingeniería de fiabilidad de sitios (SRE), incluyendo al menos un servicio de producción del que hayas sido responsable de mantener. Te pediremos que nos lo expliques en detalle: qué falló, cómo te enteraste y qué cambiaste para que no volviera a ocurrir.
  • Administración de sistemas Linux y depuración en bare metal y máquinas virtuales. Gran parte de nuestra infraestructura no es Kubernetes.
  • Kubernetes en producción entregado mediante GitOps, incluyendo actualizaciones de clúster que hayas realizado tú mismo.
  • Infraestructura como código como forma de entrega: Ansible y Terraform o OpenTofu, con cambios revisados en merge requests.
  • Administración de GitLab y GitLab CI en producción, ya sea self-hosted o SaaS. Se acepta una experiencia profunda con otro sistema de CI si puedes demostrar la misma profundidad.
  • Conocimiento práctico del ecosistema Prometheus y Grafana: haberlo gestionado para un equipo, haber escrito reglas de alerta y dashboards, y saber leer PromQL. Se agradece la profundidad en este punto, y es algo que se puede aprender.
  • Explicación técnica escrita para ingenieros fuera de tu equipo: runbooks, avisos, respuestas a solicitudes.
  • Fuertes habilidades de comunicación e interpersonales. Este rol trata con personas tanto como con servidores: la mayor parte del trabajo comienza como una conversación con un equipo de producto, y necesitas entender lo que realmente necesitan, acordar el alcance, la prioridad y los tiempos con ellos, rebatir cortésmente cuando una solicitud no deba hacerse como se pide, y mantener a todos informados mientras el trabajo está en curso. Buscamos a alguien con quien otros equipos disfruten trabajando.
  • Uso avanzado de asistentes de ingeniería de IA como Claude y Codex: proporcionar contexto, desglosar tareas, diseñar bucles de agentes y delegar planes para una ejecución autónoma de extremo a extremo dentro de un alcance y permisos definidos, con condiciones de parada claras. Debes ser capaz de explicar, depurar y probar la automatización resultante, y verificar los comandos, scripts y conclusiones generados antes de que toquen producción.
  • Inglés - nivel intermedio-alto o superior - para garantizar una comunicación clara del progreso dentro de los equipos.

Se valorará

  • Diseño de alertas: SLOs, alertas de tasa de consumo (burn-rate) y umbrales dimensionados a partir de datos.
  • Aislamiento de MicroVM para CI: Kata Containers, Firecracker o gVisor.
  • Operaciones de almacenamiento de objetos compatibles con S3: Ceph RGW o similares.
  • AWS con trabajo real de costes.
  • Sentry self-hosted, u otra aplicación respaldada por Kafka, ClickHouse y Redis que hayas mantenido operativa bajo carga.
  • Python o Go para exporters y pequeños servicios internos.

No es necesario que hayas gestionado cada sistema de esta lista. Unos fundamentos sólidos y el criterio para aprender un servicio desconocido, hacerlo observable y entregar un runbook importan más que cumplir cada línea.

El puesto

CloudLinux desarrolla productos de seguridad e infraestructura Linux. Te unirás a nuestra célula de Automation & Management Services, trabajando estrechamente con Dmitrii Petrov para resolver problemas en distintos equipos y servicios: datos de costes de la nube, inventario de infraestructura, políticas de red y flujos de trabajo de capacidad.

Dentro del Departamento de Infraestructura, la célula de Platform es un equipo pequeño. Gestionamos la plataforma de observabilidad, el GitLab de la empresa y los runners de CI que lo sustentan, algunos servicios de ingeniería más pequeños y la automatización en la que el departamento confía para el aprovisionamiento y la configuración.

Buscamos un Platform Engineer para el equipo de PaaS que se haga responsable de un conjunto acordado de servicios de plataforma: mantenerlos fiables y dentro de los niveles de servicio acordados, hacer que los cambios y la recuperación sean repetibles, y reducir el trabajo operativo recurrente mediante la automatización y el autoservicio.

Tendrás verdadera libertad en la forma en que implementas las cosas y serás responsable del resultado: tú eliges el enfoque, lo defiendes en la revisión y respondes de cómo se comporta el servicio posteriormente.

La mayor parte del trabajo consiste en lo que trata la ingeniería de fiabilidad de sitios (SRE): servicios que funcionan bien día tras día y solicitudes de los equipos de producto gestionadas correctamente. Una parte es construcción. La plataforma de observabilidad y el clúster de runners se construyeron desde cero en el último año, y habrá más de esto. Espera que el trabajo se divida entre ingeniería de plataforma, respuesta a incidentes y ayuda a los ingenieros de otros equipos para que utilicen lo que gestionamos.

Qué harás

  • Gestionar la plataforma de observabilidad. Mantenerla saludable, incorporar equipos, vigilar el coste y la capacidad, y mantener el sistema de alertas que funciona sobre ella.
  • Gestionar GitLab y la flota de runners de CI. Actualizaciones, capacidad, acceso, copias de seguridad y simulacros de restauración.
  • Mantener saludables el resto de nuestros servicios, con la monitorización y los runbooks que necesita un servicio de producción.
  • Desplegar nuevos servicios cuando se soliciten. Investigar las opciones, elegir un diseño y levantar el servicio desde cero siguiendo las buenas prácticas: como código, monitorizado, con copias de seguridad y documentado.
  • Trabajar con las solicitudes de los desarrolladores. Acceso, incorporación, problemas de pipelines, nuevos exporters y dashboards. Responder a ellos y convertir los recurrentes en autoservicio.
  • Gestionar incidentes. Diagnosticar y mitigar el impacto, restaurar el servicio de forma segura y, después, completar el análisis de causa raíz y el post-mortem. Implementar las mejoras de prevención o detección que el incidente requiera.
  • Enviar todo como código, revisado en merge requests. Planificar y comprobar antes de cada cambio.
  • Escribir para ingenieros fuera del equipo. Runbooks, guías de incorporación, avisos de mantenimiento y actualizaciones de estado sobre las que la gente pueda actuar.
  • Trabajar con agentes de IA. Delegarles la recopilación y la redacción, revisar su resultado como lo harías con el merge request de un colega, y registrar lo que aprendas donde el equipo pueda encontrarlo.

Sitio web

Consulta nuestro sitio web para más información https://cloudlinux.com/

En qué no se centra este rol

  • No es un operador de cola de tickets. Las solicitudes recurrentes se convierten en autoservicio, no se procesan una por una para siempre.
  • No es un rol puramente de cloud o Kubernetes. El bare metal y las máquinas virtuales son una gran parte de nuestra infraestructura.
  • No es el DBA, el ingeniero de redes o el ingeniero de seguridad. Esos equipos gestionan sus propios sistemas; nosotros proporcionamos la plataforma con la que los monitorizan.

Sobre Cloudlinux

CloudLinux es una empresa de software que desarrolla sistemas operativos y soluciones de seguridad para entornos de hosting basados en Linux. Su producto insignia, CloudLinux OS, es una distribución comercial de Linux diseñada para proveedores de hosting compartido, que ofrece mayor seguridad, estabilidad y rendimiento mediante funciones como LVE (Lightweight Virtual Environment) y KernelCare, que proporciona parches de kernel en vivo sin necesidad de reinicios. La empresa también ofrece productos como Imunify360 para la seguridad de servidores y KernelCare para sistemas empresariales, sirviendo a una base global de clientes compuesta por empresas de hosting y centros de datos.

CloudLinux tiene una presencia significativa en España, con una oficina de desarrollo en Valencia, que es un centro clave para sus equipos de ingeniería. La empresa es conocida por su cultura de trabajo remoto, que permite a los empleados trabajar desde cualquier lugar, y contrata activamente talento internacional para puestos en ingeniería, seguridad e infraestructura. Para los profesionales internacionales, CloudLinux ofrece un entorno colaborativo con un enfoque en tecnologías de código abierto y software de sistemas de vanguardia, lo que lo convierte en una opción atractiva para quienes buscan trabajo remoto en la industria tecnológica.

Fundación
2009
Plantilla
200–500
Sede
Palo Alto, USA
En España
Valencia

Datos prácticos

  • CloudLinux ofrece puestos totalmente remotos, lo que permite a los empleados trabajar desde cualquier lugar del mundo, incluida España.
  • La empresa tiene una oficina de desarrollo en Valencia, España, que sirve como centro para los equipos de ingeniería y seguridad.
  • CloudLinux es conocida por su enfoque en tecnologías de código abierto y sus contribuciones al ecosistema Linux, lo que puede resultar atractivo para los desarrolladores.
  • La empresa ofrece un entorno de trabajo flexible con un fuerte énfasis en el equilibrio entre la vida laboral y personal y el crecimiento profesional.
  • Los contratados internacionales pueden esperar una cultura colaborativa con miembros del equipo distribuidos en múltiples zonas horarias.

En sus propias palabras

Información adicional

Al solicitar este puesto, consientes el tratamiento de tus datos personales según se describe en nuestra Política de Privacidad (https://cloudlinux.com/candidate-privacy-notice), que proporciona información detallada sobre cómo mantenemos y gestionamos tus datos.

Todas las vacantes de Cloudlinux
WhatsApp

Pasante de Desarrollador C

CloudlinuxHace 1 sem.
En remoto, Madrid

Product Owner - Imunify Email

CloudlinuxHace 1 sem.
En remoto, Madrid

Ingeniero de Software Python

CloudlinuxHace 1 sem.
En remoto, Madrid
En remoto, Madrid

Ingeniero Staff

CloudlinuxHace 1 meses
En remoto, Madrid

Ingeniero de Pipelines

CloudlinuxHace 1 meses
En remoto, Madrid
En remoto, Madrid
Ver los 10 empleos