Data Engineer — Confiabilidad del Dato (Región Metropolitana)

Data Engineer — Confiabilidad del Dato (Región Metropolitana)

15 ago
|
Clay
|
Región Metropolitana

15 ago

Clay

Región Metropolitana

En Clay recibimos información desde distintas fuentes externas: bancos, SII y documentos tributarios electrónicos. Nuestro equipo de Integraciones construye y mantiene los procesos que permiten obtener esa información, a través de scrapers, APIs y otras integraciones. Este rol será parte de ese equipo y participará en el desarrollo y mantenimiento de esas integraciones, pero tendrá un foco especial: asegurar que el dato que llega a Clay sea correcto y confiable. Porque un proceso puede terminar exitosamente y aun así traer información incompleta, duplicada, desactualizada o distinta a la fuente original. Queremos construir mecanismos que nos permitan detectar esos problemas antes que nuestros clientes y, cuando sea posible, resolverlos automáticamente. Nos encantaría sumar a alguien que ya haya trabajado con este tipo de problemas y pueda ayudarnos a construir esta capacidad mejor de lo que lo haríamos solos.
?¿Qué harás? Confiabilidad del dato Definir qué significa que un dato esté correcto para cada fuente: completitud, consistencia, frescura y cuadratura contra el origen. Construir validaciones y reconciliaciones que detecten inconsistencias, incluso cuando técnicamente el proceso haya terminado correctamente. Diseñar estas garantías para que funcionen independientemente de si el dato proviene de un scraper, una API u otra integración. Detección y recuperación Instrumentar métricas, logs y alertas sobre los procesos de ingesta. Construir mecanismos para que Clay detecte inconsistencias antes de que las reporte un cliente. Diseñar procesos de recuperación y automatizaciones para resolver fallas sin depender de que una persona esté monitoreando constantemente. Construir agentes y herramientas internas que ayuden a automatizar la detección, diagnóstico y resolución de estos problemas. Integraciones Desarrollar y mantener integraciones,



tanto mediante scraping como APIs, etc. Diseñar procesos sobre AWS (Lambda, SQS, EventBridge) y MongoDB considerando escala, resiliencia y observabilidad. Tomar problemas poco definidos, investigarlos y llevar una solución hasta producción. Participar en las decisiones técnicas y aportar desde tu experiencia. ? Cómo trabajamos La IA forma parte de nuestro flujo diario de desarrollo: la usamos para programar, revisar PRs, investigar problemas y diseñar soluciones. Buscamos que nos haga más productivos, pero el criterio técnico, la calidad y las decisiones siguen siendo responsabilidad de cada persona. También nos importa que las soluciones queden bien construidas, probadas, observables y documentadas.

Requisitos

Imprescindible Experiencia trabajando con calidad y confiabilidad de datos. Has trabajado con pipelines o integraciones donde era relevante validar que la información recibida fuera realmente correcta. Conoces problemas como datos faltantes, duplicados, retrasos, inconsistencias y cambios inesperados en las fuentes. Observabilidad en producción. Has trabajado con métricas, logs y alertas para detectar problemas antes de que los reporte un usuario. Python sólido, con experiencia real. Experiencia con AWS y MongoDB —o tecnologías equivalentes— en ambientes productivos. Autonomía: puedes tomar un problema ambiguo, investigarlo y llevar una solución hasta producción. Buenas prácticas de desarrollo: tests, Git, PRs y revisión de código.



Experiencia desarrollando con herramientas de IA como Claude Code, Cursor, Copilot o similares, entendiendo cuándo confiar en ellas y cuándo cuestionarlas. Deseable Suma, pero no es requisito: Experiencia con SLOs, incidentes o postmortems. Automatización de procesos operativos o agentes de IA internos. Conocimiento del ecosistema tributario chileno (SII, DTE, RCV, facturación electrónica) o experiencia en fintech. CI/CD y monorepos.

Beneficios

? Modalidad híbrida / remoto. ? 5 semanas de vacaciones al año. ?‍⚕️ Seguro complementario de salud y dental (copago). ? Pagamos los primeros 3 días de licencia médica. ? Reajuste por IPC cada 6 meses. ? Día libre en tu cumpleaños (y ½ día para el de tus hijos). ? Una tarde libre al mes para recargar energías. ? 3 días administrativos para trámites personales. ⏰ Dueño/a de tu tiempo, con foco en resultados y aprendizaje. Si esto sí suena como algo que te entusiasma, ¡nos encantaría conocerte! ? Para eso, es súper importante que respondas a las preguntas que aparecen en la postulación (si no las ves, probablemente estás postulando desde Laborum y significa que te llegarán por correo. Eso depende la plataforma por la que postules). IMPORTANTE: no se considerarán las postulaciones sin respuestas a las preguntas.

Los datos que entregas en este proceso de selección serán tratados por Clay Technologies SpA (RUT 76.570.751-K) para evaluar tu postulación al cargo. Conservamos tus datos mientras dure el proceso; si no resultas seleccionado, se eliminan conforme a nuestra política de retención, salvo que aceptes expresamente quedar disponible para futuros procesos. Puedes ejercer tus derechos de acceso, rectificación, supresión u oposición escribiendo a [email protected].

📌 Data Engineer — Confiabilidad del Dato (Región Metropolitana)
🏢 Clay
📍 Región Metropolitana

Postulate a este anuncio

Muestra tus habilidades a la empresa, rellenar el formulario y deja un toque personal en la carta, ayudará el reclutador en la elección del candidato.

Suscribete a esta alerta:

Recibe por email las nuevas ofertas de trabajo para: data engineer — confiabilidad del dato (región metropolitana) / región metropolitana

Suscribete a esta alerta:

Recibe por email las nuevas ofertas de trabajo para: data engineer — confiabilidad del dato (región metropolitana) / región metropolitana