11 oct
|
Get on Board
|
Santiago
11 oct
Get on Board
Santiago
Tu misión será diseñar, integrar y operar los flujos de datos de nuestros clientes, asegurando calidad, trazabilidad y cifras que cuadren con el origen.
Reportarás al Líder de Inteligencia.
Detrás de cada almacén, ferretería o botillería hay una familia que queremos ayudar a vender más y estar mejor abastecida.
Y todo comienza con datos confiables y oportunos.
Somos obsesivos con la precisión: si el ERP registra 100 ventas y nosotros vemos 98, buscamos las 2 faltantes.
Un dato incorrecto afecta decisiones comerciales y la experiencia de los usuarios de nuestro Agente Conversacional.
Hoy estamos transformando nuestra tecnología: unificamos el stack, estandarizamos integraciones desde ERPs, SFTP y APIs, e incorporamos validaciones de calidad en cada etapa.
Es una prioridad estratégica de la compañía, con recursos asignados, y buscamos a quien lidere este desafío junto al equipo de Data Intelligence.
Lo que vas a hacer
Diseñar, construir y operar pipelines de integración desde el origen de cada cliente (ERPs, APIs REST, webhooks, SFTP, VPN, archivos en S3) hasta PostgreSQL en AWS RDS.
Escribir procesos ETL y ELT en Python, orquestados con Apache Airflow.
Migrar los pipelines legados (AWS Glue y flujos heredados) al nuevo stack.
Definir contratos de datos declarativos por cliente y entidad: esquema, tipos, vocabularios, ventanas de entrega y umbrales de cuarentena.
Implementar reglas de calidad por dimensión (completitud, validez, unicidad, integridad referencial, consistencia, oportunidad) y verificar que cada transformación preserve los invariantes del dato.
Diseñar el modelo de datos,
versionarlo con migraciones y hacer el onboarding de clientes nuevos.
Construir la observabilidad del pipeline: hallazgos de calidad por corrida, alertas y detección de fallas silenciosas, como el proceso que termina "con éxito" sin haber recibido un solo archivo.
Cuadrar nuestras cifras con las del cliente, explicar cada diferencia y arreglar la causa en el pipeline.
Gestionar accesos y credenciales de procesos y cuentas de servicio con mínimo privilegio.
Documentar flujos, contratos de datos y procedimientos operativos.
Trabajar con data science, producto e ingeniería en los datos que alimentan el motor de recomendaciones y la plataforma.
Lo que buscamos
Experiencia
5+ años en roles de datos, o 3+ años como Data Engineer construyendo y operando pipelines en producción.
Python y SQL
Python avanzado para procesamiento de datos (pandas), con tests automatizados (pytest).
SQL avanzado en PostgreSQL: modelado, índices, planes de ejecución y cargas incrementales (upserts).
Calidad y contratos de datos
Validación de datos con esquemas y contratos (pandera, pydantic, Great Expectations o similares).
Criterio para pensar la calidad del dato desde el diseño del pipeline.
AWS: S3, RDS y al menos un servicio de procesamiento (Glue, Lambda, Batch o ECS).
Diseñaste integraciones batch y streaming (eventos, webhooks, CDC o colas de mensajes).
Migraste pipelines entre plataformas sin detener la operación.
Manejas migraciones de esquema y versionamiento del modelo de datos.
Diseñas software desacoplado y mantenible (SOLID, arquitectura hexagonal o similar).
Trabajaste con bases NoSQL, en particular MongoDB.
Conoces contenedores y CI/CD.
Integraste ERPs (SAP u otros) y entiendes su modelo comercial: facturas, pedidos, catálogo y clientes.
Usas IA aplicada al desarrollo (Claude Code, MCP u otras): agentes, subagentes, skills y flujos automatizados con LLMs.
Te sientes cómodo/a levantando requerimientos directo con los equipos técnicos de los clientes.
Documentas tus decisiones y sabes explicar un problema de datos a alguien que no es técnico.
Conoces la industria de consumo masivo, distribución o e-commerce B2B.
Lees inglés técnico sin problema (documentación, librerías, cursos).
Lo que te ofrecemos
Pipelines reales en producción, con ownership de punta a punta.
Un equipo en crecimiento, con stack moderno y uso intensivo de IA en el día a día.
Modalidad mixta y horario flexible.
Beneficios de deporte, educación, compra de equipo y días administrativos.
5 días extras de vacaciones
Cultura horizontal y cercana.
Somos una empresa que busca habilitar el crecimiento y la prosperidad de los almaceneros de barrio a través de la digitalización de la cadena de valor comercial en el canal tradicional mediante soluciones tecnológicas.
— YOM's full profile
#J-*****-Ljbffr
📌 Data Engineer · Yom Full Time (Santiago)
🏢 Get on Board
📍 Santiago