Proton.ai busca un Ingeniero/a de Datos Senior para liderar su Capa de Datos, enfocándose en la arquitectura, pipelines y reconciliación de datos para productos y su IA. Requiere 7+ años de experiencia, fuerte manejo de SQL y programación, y uso diario de herramientas de IA para desarrollo.
Si sos un/a crack del SQL y la programación con más de 7 años de experiencia, esta es tu oportunidad. Podés liderar la capa de datos de una empresa que está revolucionando la distribución con IA, trabajando 100% remoto.
Senior Data Engineer (AI-Native) — Data Layer Sobre nosotros Proton está construyendo el sistema operativo de IA para la distribución mayorista, integrado en los flujos de trabajo que mueven casi todos los productos físicos del planeta. La distribución es una industria de 9 billones de dólares, y el software que la ejecuta ha estado estancado en el pasado durante décadas; la mayoría de las herramientas crean más trabajo del que eliminan. Unificamos CRM, PIM, IA de eCommerce y IA de Pedidos y Cotizaciones en una sola plataforma con una única capa de datos y un único cerebro de IA, para que los representantes dediquen su tiempo a profundizar las relaciones con los clientes, no a ingresar datos. Contratamos personas con alta iniciativa y alta urgencia. En Proton, todos son constructores que se apropian de los problemas de principio a fin y lanzan software nativo de IA más rápido que nadie en la categoría. El cliente promedio de Proton reporta un retorno de ganancias 3 veces mayor por dólar gastado, un día adicional de ventas por representante al mes y “el mejor ROI de cualquier inversión tecnológica en 30 años”. Cientos de distribuidores líderes, desde tiendas familiares hasta empresas que cotizan en bolsa en los sectores industrial, HVAC y eléctrico, operan con Proton. Contamos con el respaldo de Felicis Ventures (Twitch, Shopify, Opendoor) y Battery Ventures. Si quieres construir los sistemas que dan forma a cómo se mueven billones de dólares en bienes físicos a través de la economía, Proton es el lugar para hacerlo. El Rol Estamos contratando un Ingeniero de Datos Senior para que se encargue y haga crecer nuestra **Capa de Datos** — la base unificada sobre la que se construyen todos los productos de Proton y nuestro cerebro de IA. Serás responsable de los pipelines y la arquitectura de principio a fin: las capas estilo medallón (raw → refined → curated), la ingesta desde una amplia gama de sistemas y el servicio del que depende toda la empresa. Estamos invirtiendo fuertemente para hacer que la Capa de Datos sea más grande y mejor, y este rol es para alguien que quiera hacer el trabajo práctico de construcción *y* dar forma a hacia dónde va a continuación. Dos cosas hacen que este rol sea diferente de una apertura estándar de ingeniería de datos: 1. **Eres un operador nativo de IA, no un autor de pipelines.** Todos los ingenieros en Proton usan Claude Code y otras herramientas agentivas como colaboradores de primera clase. Esperamos que los pipelines, modelos y migraciones se construyan y lancen con un fuerte apalancamiento de IA: tú guías a los agentes, validas la salida y tomas las decisiones que ellos no pueden. 2. **Eres responsable de la capa sobre la que todo se ejecuta.** Cuando la IA da una respuesta incorrecta o un número no coincide con la fuente, el rastro lleva de vuelta a los datos. Eres responsable de la corrección de principio a fin: ingesta, modelado, reconciliación y los contratos de los que dependen otros equipos. **Ubicación:** Europa, remoto. Se requiere superposición significativa durante el horario diurno con nuestro equipo de Boston (EST). Qué harás - Ser responsable de la Capa de Datos de principio a fin: ingesta desde fuentes basadas en archivos, eventos y API; el modelo estilo medallón (raw → refined → curated); y la capa de servicio que potencia el producto y el cerebro de IA. - Construir y operar los pipelines de ingesta y transformación que potencian la Capa de Datos, utilizando un marco de orquestación moderno y un data warehouse en la nube. - Ingerir y reconciliar datos grandes, desordenados y del mundo real de muchos tipos y formas de origen: archivos batch, eventos de streaming y API. - Modelar datos a través de capas de medallón para que sean confiables, consultables y estables para los equipos downstream y la IA. - Ayudar a llevar la Capa de Datos al siguiente nivel: mejor arquitectura, mejores herramientas, más escala, más fuentes, y tener una voz real en cómo se verá eso. - Operar agentes de codificación de IA (Claude Code y similares) a un alto nivel: definir el alcance del trabajo, estructurar el contexto, ejecutar agentes en paralelo cuando sea apropiado y lanzar resultados revisados y de calidad de producción. - Construir los sistemas que hacen que los datos sean confiables: validación, reconciliación, linaje, backfills, cargas idempotentes e incrementales, para que los equipos downstream y la IA no hereden errores silenciosos. - Asociarse con ingenieros de backend, IA y producto (y ocasionalmente con los equipos de TI de los clientes) para definir los contratos de datos sobre los que construyen. Requisitos - Más de 7 años de experiencia práctica como ingeniero de datos con propiedad de producción real y demostrable: pipelines y modelos de datos que sirven a usuarios reales a escala. - Fundamentos sólidos. Entiendes lo que hacen tu código y tus consultas y por qué. Puedes leer un plan de consulta, razonar sobre un pipeline lento o costoso y depurar un error de corrección de datos hasta su raíz. - Sólidas habilidades de programación y SQL. Construyes pipelines, esquemas y consultas eficientes, y puedes modelar datos para patrones de acceso transaccional y analítico. - Experiencia práctica en orquestación, construyendo pipelines de ingesta/ELT confiables contra fuentes upstream desordenadas. - Experiencia con un data warehouse en la nube y una plataforma en la nube importante. - Experiencia ingiriendo desde múltiples tipos de fuentes: **basadas en archivos, eventos/streaming y basadas en API**. - Sólida comprensión de los modos de falla de consistencia de datos: cargas parciales, datos tardíos o fuera de orden, idempotencia, backfills, deriva de esquemas. - Uso diario y práctico de herramientas de desarrollo agentivas (Claude Code, modo agente de Cursor, Codex o equivalente) para lanzar trabajo real. Puedes hablar concretamente sobre cómo estructuras prompts, gestionas el contexto, paraleliza agentes y verificas su salida. - Propiedad y juicio. Llevas los sistemas de datos de la idea a la producción y ejerces buen gusto sobre qué construir y qué descartar. - Mentalidad de startup y fuerte comunicación: pragmático, rápido, con sesgo a lanzar, y capaz de explicar decisiones de datos a ingenieros, PMs y clientes por escrito. - Inglés nivel C1 o superior. Gran Plus - Profunda experiencia en data warehouse en la nube y herramientas de transformación modernas. - Ingesta de streaming/eventos a escala. - Experiencia en arquitectura Medallion o lakehouse en datos grandes y multiorigen. - Experiencia integrando fuentes empresariales como ERP (Epicor Eclipse, Prophet 21) o sistemas de comercio electrónico, y reconciliando datos transaccionales desordenados. - Construcción de sistemas de datos que alimentan productos de IA/ML o agentivos: capas de servicio/características, recuperación o contratos de datos para entradas de modelos. - Experiencia previa en una startup SaaS en etapa temprana.