Buscamos un Data Engineer Senior para diseñar e implementar pipelines de datos, consolidar tablas transaccionales en tablas analíticas y construir una capa de análisis centralizada. Se requiere experiencia en SQL, Python, PostgreSQL, modelado dimensional, AWS Data Stack y gestión de datos maestros.
Si sos un Data Engineer Senior con experiencia en SQL, Python y AWS, esta oportunidad remota en Binagora te permite diseñar la arquitectura de datos de una plataforma líder en desarrollo profesional para firmas de contabilidad. Vas a consolidar datos transaccionales en tablas analíticas, optimizando la información para análisis.
Acerca de Binagora En Binagora, somos una comunidad totalmente remota de *software crafters* con más de una década de experiencia colaborando con clientes internacionales. Trabajamos con organizaciones audaces para entregar soluciones personalizadas de alta calidad que logran resultados tangibles. Nuestra experiencia abarca diversos sectores, incluyendo Media & Entertainment, Energía Solar, Salud, Marketing, Auditoría y Cumplimiento, Diversidad e Inclusión, entre muchos otros. Desde la estrategia inicial hasta la entrega final, vamos más allá, infundiendo creatividad y alineándonos con los objetivos comerciales para desarrollar productos innovadores que desafían las convenciones y impulsan los negocios. Nuestro Cliente Nuestro cliente ofrece la plataforma líder de desarrollo profesional diseñada exclusivamente para firmas de contabilidad y asesoría. Ofrecen la única solución integral para gestionar el cumplimiento de aprendizaje, iniciativas de L&D, seguimiento de asistencia y contenido de capacitación. Con la confianza de más de 130 de las 200 principales firmas, su plataforma cuenta con una retención de clientes superior al 99%, ayudando a administradores y especialistas en cumplimiento a ahorrar incontables horas en tareas manuales y eliminar errores de riesgo. Responsabilidades Buscamos un Ingeniero de Datos autónomo y práctico para construir la base de datos que impulsa a toda la organización. Actualmente, nuestros datos residen en más de 250 tablas transaccionales actualizadas semanalmente. Serás responsable de consolidar esto en aproximadamente 10 tablas analíticas bien definidas, transicionar de actualizaciones completas a cargas incrementales diarias (o mejores) y establecer una capa de análisis centralizada de la que BI, producto e IA puedan extraer con confianza. Responsabilidades: - Diseñar e implementar *data pipelines*. - Consolidar más de 250 tablas transaccionales en ~10 tablas analíticas. - Pasar de actualizaciones completas semanales a cargas incrementales diarias/casi en tiempo real mediante CDC (por ejemplo, AWS DMS). - Construir y ser dueño de la capa de análisis centralizada. - Establecer definiciones de datos unificadas, métricas, KPIs y benchmarks en toda la organización. - Entregar un marco de Master Data Management (MDM) con definiciones unificadas y estándares de gobernanza. - Impulsar la migración a la capa centralizada mientras se deprecian los accesos directos a tablas crudas. - Colaborar con departamentos internos para impulsar el autoservicio de análisis y construir agregaciones/data marts para benchmarking y experimentación. - Realizar análisis exploratorios y estadísticos para la validación de datos, e implementar observabilidad/monitoreo de datos. - Colaborar con el Ingeniero de IA Aplicada para diseñar modelos de datos listos para IA (incluyendo estructuras listas para *retrieval* y *embedding* para fundamentar aplicaciones RAG y LLM). - Expandir el *data lake* para ingerir fuentes de terceros (por ejemplo, HubSpot, Jira, Zendesk). Requisitos Indispensables: - Más de 5 años de experiencia en ingeniería de datos construyendo/operando *pipelines* de producción y capas analíticas. - Sólidos conocimientos de SQL y Python, con profunda experiencia práctica en PostgreSQL. - Profunda experiencia en modelado dimensional y consolidación de esquemas transaccionales en tablas analíticas. - Experiencia práctica con Change Data Capture (CDC) y estrategias de carga incremental. - Experiencia práctica con el stack de datos de AWS (Athena, Glue, DMS, S3, RDS, Lambda). - Experiencia comprobada en el establecimiento de Master Data Management (MDM), definiciones de métricas y gobernanza de datos. - Experiencia práctica en la construcción de *pipelines* listos para IA (datos listos para *retrieval/embedding* para aplicaciones RAG/LLM). Requisitos Deseables: - Experiencia integrando herramientas SaaS de terceros (HubSpot, Jira, Zendesk) en *data lakes/warehouses*. - Experiencia colaborando con equipos de IA/ML en *feature stores* y *pipelines* de evaluación de ML. - Familiaridad con herramientas de observabilidad y monitoreo de calidad de datos. - Experiencia en plataformas SaaS multi-tenant, edtech o de cumplimiento. Beneficios: - Cultura basada en la confianza: Valoramos mucho la propiedad y confiamos en las habilidades y la antigüedad de nuestro equipo para alcanzar los objetivos. - Trabajo remoto: ¡Disfruta trabajando de forma remota! Estamos distribuidos en diferentes ubicaciones en LATAM y Europa. - Política de tiempo libre flexible. - Proyectos diversos e impactantes: Participa en desafíos complejos para actores importantes en Media & Entertainment, junto con startups innovadoras en Energía Solar, Cumplimiento y otros sectores dinámicos. - Aprendizaje y desarrollo: Obtén la oportunidad de tomar clases de inglés, capacitaciones y certificaciones. - Programa de referidos: ¡Valoramos la conexión! Nuestro programa de referidos ofrece bonificaciones por referencias exitosas. - Fuerte cultura y tradiciones: Fomentamos un ambiente de trabajo solidario y atractivo, destacado por nuestra "Binagora Week" anual, reuniones de equipo regulares y regalos para ocasiones especiales.