Hasta 40 US$
🇬🇧Ingeniero Sénior de Scraping de Datos con Python (Freelance)
En remoto desde España·Jornada parcial·Añadida hace 5 días
41 ofertas abiertas
Qué ofrecen
Hasta 40 US$ la hora
Bruto, según indica la oferta.
Jornada parcial
Según la oferta.
Totalmente en remoto
Según la oferta.
Qué piden
Trabajar en inglés
Se requiere inglés, según la oferta.
Tener 5+ años de experiencia
Puesto de nivel Senior.
Lo más probable es que necesites inglés para inscribirte.Esta oferta se ha traducido automáticamente al español,.
El puesto
Mindrift busca especialistas en Vibecode altamente cualificados para unirse al proyecto Tendem (https://tendem.ai/) e impulsar flujos de trabajo especializados de extracción de datos para casos de uso del mundo real. Mindrift busca Senior Python Data Scraping Engineers altamente cualificados para unirse al proyecto Tendem e impulsar flujos de trabajo especializados de extracción de datos para aplicaciones del mundo real. En este puesto, aplicarás tu experiencia en web scraping, extracción y procesamiento de datos para ofrecer resultados precisos, fiables y de alta calidad. Esta oportunidad remota a tiempo parcial es ideal para profesionales técnicos con experiencia práctica en web scraping, extracción y procesamiento de datos.
Este es un puesto freelance para un proyecto de Tendem. Como Senior Python Data Scraping Engineer, te encargarás de tareas de extracción de datos que requieren precisión técnica para la extracción y el procesamiento web, utilizando herramientas como Apify, OpenRouter y otras tecnologías, junto con tu propia experiencia y enfoques técnicos.
Qué harás
- Gestionar flujos de trabajo de extracción de datos de extremo a extremo en sitios web complejos, garantizando una cobertura completa, precisión y una entrega fiable de conjuntos de datos estructurados.
- Aprovechar las herramientas disponibles y los flujos de trabajo personalizados para acelerar la recopilación, validación y ejecución de tareas, cumpliendo al mismo tiempo con los requisitos definidos.
- Garantizar una extracción fiable de fuentes web dinámicas e interactivas, adaptando los enfoques según sea necesario para gestionar contenido renderizado mediante JavaScript y el comportamiento cambiante de los sitios.
- Aplicar estándares de calidad de datos mediante controles de validación, controles de consistencia entre fuentes, cumplimiento de las especificaciones de formato y verificación sistemática antes de la entrega.
- Escalar las operaciones de scraping para grandes conjuntos de datos mediante el uso eficiente de lotes o paralelización, supervisar los fallos y mantener la estabilidad frente a cambios menores en la estructura del sitio.
Cómo trabajarás
Para este proyecto, se estima que las tareas requerirán alrededor de 10-20 horas por semana durante las fases activas, según los requisitos del proyecto. Esta es una estimación, no una carga de trabajo garantizada, y se aplica únicamente mientras el proyecto esté activo.
Requisitos
Qué buscan
Cualificaciones educativas
- Al menos 5 años de experiencia relevante en ingeniería de datos, web scraping, automatización o desarrollo de software (obligatorio).
- Se valorará poseer un título de Grado o Máster en Ingeniería, Matemáticas Aplicadas, Informática o campos técnicos relacionados.
Experiencia académica y/o profesional
Los candidatos deben tener una base técnica sólida y experiencia práctica con scripting, automatización y flujos de trabajo de extracción de datos. Buscamos especialistas que puedan resolver problemas no triviales, trabajar con confianza con herramientas y tecnologías de desarrollo modernas, y recopilar, estructurar y validar datos de diversas fuentes de forma sistemática. Un enfoque metódico y orientado al detalle, así como la capacidad de trabajar de forma independiente, son esenciales.
Habilidades técnicas (Esenciales)
- Sólida experiencia en web scraping con Python (BeautifulSoup, Selenium o similares), incluyendo contenido dinámico (JS, AJAX, scroll infinito) y APIs a través de proxies
- Capacidad demostrada para extraer datos de estructuras complejas (jerarquías, páginas archivadas, HTML inconsistente)
- Sólida formación en limpieza, normalización y validación de datos, entregando conjuntos de datos estructurados (CSV, JSON, Google Sheets)
Requisitos adicionales
- Experiencia demostrada en el manejo de mecanismos anti-bot y estructuras de sitios dinámicos a escala
- Experiencia con infraestructura en la nube (AWS o equivalente) y contenerización (Docker) como parte de flujos de trabajo reales
- Experiencia práctica con frameworks de LLM (LangChain, OpenRouter o similares) aplicados a tareas de automatización
- Gran atención al detalle y compromiso con la precisión de los datos
- Ética de trabajo autónoma con capacidad para la resolución de problemas de forma independiente
- Se valorará un enlace a GitHub
- Competencia en inglés: Nivel intermedio-alto (B2) o superior (obligatorio)
Salario y beneficios
Qué ofrecen
En este proyecto, los colaboradores pueden ganar hasta el equivalente a $40 por hora, dependiendo de su nivel y ritmo de contribución. La compensación varía entre proyectos según el alcance, la complejidad y la experiencia requerida. Ten en cuenta que otros proyectos en la plataforma pueden ofrecer diferentes niveles de ingresos según sus requisitos.
El puesto
Mindrift is looking for highly skilled Vibecode specialists to join the Tendem project (https://tendem.ai/) and drive specialized data scraping workflows for real-world use cases. Mindrift is looking for highly skilled Senior Python Data Scraping Engineers to join the Tendem project and drive specialized data scraping workflows for real-world applications. In this role, you'll apply your expertise in web scraping, data extraction, and data processing to deliver accurate, reliable, and high-quality results. This part-time remote opportunity is ideal for technical professionals with hands-on experience in web scraping, data extraction and processing.
This is a freelance role for a Tendem project. As a Senior Python Data Scraping Engineer, you'll handle data scraping tasks requiring technical precision for web extraction and processing, utilizing tools such as Apify, OpenRouter, and other technologies, alongside your own technical expertise and approaches.
Qué harás
- Own end-to-end data extraction workflows across complex websites, ensuring complete coverage, accuracy, and reliable delivery of structured datasets.
- Leverage available tools and custom workflows to accelerate data collection, validation, and task execution while meeting defined requirement.
- Ensure reliable extraction from dynamic and interactive web sources, adapting approaches as needed to handle JavaScript-rendered content and changing site behavior.
- Enforce data quality standards through validation checks, cross-source consistency controls, adherence to formatting specifications, and systematic verification prior to delivery.
- Scale scraping operations for large datasets using efficient batching or parallelization, monitor failures, and maintain stability against minor site structure changes.
Cómo trabajarás
For this project, tasks are estimated to require around 10-20 hours per week during active phases, based on project requirements. This is an estimate, not a guaranteed workload, and applies only while the project is active.
Requisitos
Qué buscan
Educational qualifications
- At least 5+ years of relevant experience in data engineering, web scraping, automation, or software development (required).
- Bachelor's or Master's Degree in Engineering, Applied Mathematics, Computer Science, or related technical fields is a plus.
Academic and/or Professional Experience
Candidates should have a strong technical foundation and practical experience with scripting, automation, and data extraction workflows. We are looking for specialists who can solve non-trivial problems, work confidently with modern development tools and technologies, and systematically collect, structure, and validate data from diverse sources. A methodical, detail-oriented approach and the ability to work independently are essential.
Technical Skills (Essential)
- Strong experience in Python web scraping (BeautifulSoup, Selenium or similar), including dynamic content (JS, AJAX, infinite scroll) and APIs via proxies
- Proven ability to extract data from complex structures (hierarchies, archived pages, inconsistent HTML)
- Solid background in data cleaning, normalization, and validation, delivering structured datasets (CSV, JSON, Google Sheets)
Additional requirements
- Demonstrated experience handling anti-bot mechanisms and dynamic site structures at scale
- Experience with cloud infrastructure (AWS or equivalent) and containerization (Docker) as part of real workflows
- Hands-on experience with LLM frameworks (LangChain, OpenRouter, or similar) applied to automation tasks
- Strong attention to detail and commitment to data accuracy
- Self-directed work ethic with ability to troubleshoot independently
- A link to GitHub is a plus
- English proficiency: Upper-intermediate (B2) or above (required)
Salario y beneficios
Qué ofrecen
On this project, contributors can earn up to $40 per hour equivalent, depending on their level and pace of contribution. Compensation varies across projects depending on scope, complexity, and required expertise. Please note that other projects on the platform may offer different earning levels based on their requirements.
Sobre Mindrift
Mindrift (anteriormente Toloka AI) es una plataforma global de datos de IA que conecta a empresas con una red distribuida de profesionales independientes que entrenan, evalúan y mejoran modelos de IA. La empresa opera un mercado donde las compañías publican tareas que van desde la anotación de datos y la evaluación de IA hasta la ingeniería de software, y expertos independientes las completan de forma remota. Con una fuerza laboral de millones en todo el mundo, Mindrift es un actor clave en la cadena de suministro de datos de IA, sirviendo a clientes que incluyen grandes empresas tecnológicas.
Mindrift tiene una presencia significativa en España, con numerosos puestos remotos de freelance abiertos a profesionales de todo el país, incluidos puestos para especialistas en entrenamiento de IA, ingenieros de software y expertos en extracción de datos. El modelo de trabajo totalmente remoto de la empresa es particularmente atractivo para profesionales internacionales, ya que les permite trabajar desde cualquier lugar de España sin necesidad de reubicarse. Su plataforma ofrece trabajo flexible basado en proyectos, lo que la convierte en una opción viable para personas cualificadas que buscan complementar sus ingresos o hacer la transición al trabajo independiente.
- Sector
- AI Data
- Fundación
- 2014
- Plantilla
- 1,000–5,000
- Sede
- Amsterdam, Netherlands
- En España
- Madrid, Barcelona
- Web
- mindrift.ai
Datos prácticos
- Todos los puestos son totalmente remotos, por lo que puedes trabajar desde cualquier lugar de España sin necesidad de reubicarte.
- La plataforma ofrece trabajo flexible basado en freelance, ideal para profesionales que buscan autonomía sobre su horario.
- El trabajo se basa en proyectos y se paga por tarea, proporcionando una forma directa de monetizar tus habilidades.
- La empresa opera a nivel global, por lo que colaborarás con una comunidad diversa e internacional de expertos.
- Como plataforma de freelance, no hay una escalera profesional tradicional ni un contrato de empleo a tiempo completo.
En sus propias palabras
Sobre la empresa y el equipo
La plataforma Mindrift conecta a especialistas con proyectos tecnológicos innovadores. Nuestra misión es ayudar a desarrollar tecnologías de IA de alta calidad combinando la experiencia del mundo real de profesionales de todo el mundo con esfuerzos avanzados de desarrollo de IA.
Sobre la empresa y el equipo
The Mindrift platform connects specialists with innovative technology projects. Our mission is to help develop high-quality AI technologies by combining real-world expertise from professionals across the globe with advanced AI development efforts.




