Buscamos un Ingeniero DevOps Cloud para unirse a Azumo, empresa que construye y opera sistemas de IA de producción para clientes que van desde startups hasta Meta. Serás responsable de la infraestructura donde corren estos sistemas: los clústeres, los pipelines de despliegue y el monitoreo de su estado.
El puesto es 100% remoto en Latinoamérica, con horario alineado al día laboral del cliente. No recibirás un manual de procedimientos; en Azumo, desde 2016, trabajamos con sistemas en producción: identificamos qué se rompe, cuánto cuesta operar un clúster y qué tareas aún no se automatizaron por ser más fáciles de hacer manualmente.
Tu rol
Serás dueño de la infraestructura completa: clústeres, despliegues y todos los sistemas dependientes. Te encargarás de resolver caídas, optimizar consultas lentas y controlar costos de infraestructura.
Responsabilidades
- Construcción de clústeres robustos: Kubernetes en producción (provisionamiento, actualizaciones, redes, configuración de cargas de trabajo).
- Infraestructura como código: Uso de Terraform o similar para entornos reproducibles y detección de desviaciones.
- Pipelines de entrega: CI/CD confiables, imágenes de contenedores consistentes y despliegues a producción sin incidentes.
- Observabilidad y respuesta: Monitoreo y alertas efectivos, investigación de incidentes, identificación de causas raíz y seguimiento de cambios preventivos.
- Infraestructura para cargas de trabajo de IA: Clústeres y servicios de inferencia para ingenieros de IA, optimizando costos y escalabilidad.
- Gestión de costos y capacidad: Análisis de costos de infraestructura y planificación para escalabilidad.
- Fortalecimiento de la seguridad: Endurecimiento de Linux, Kubernetes, contenedores y service mesh, con gestión de secretos, accesos y auditorías.
- Herramientas, documentación y soporte: Desarrollo de herramientas internas, documentación operativa y soporte a desarrolladores y QA.
- Trabajo en entornos de cliente: Adaptación a los repositorios, cuentas cloud y procesos de cambio de los clientes, cumpliendo con certificaciones como SOC 2 y requisitos adicionales como HIPAA.
Metodología de trabajo
- Uso diario de herramientas de asistencia de IA (Claude Code, Codex, GitHub Copilot).
- Auditorías automatizadas de código para seguridad, costos y arquitectura.
- Neutralidad de proveedores (OpenAI, Anthropic, modelos open-weight) y uso de Valkyrie (nuestra capa de producción).
Acerca de Azumo
Somos una empresa de desarrollo de software con sede en San Francisco, especializada en aplicaciones inteligentes desde 2016. Ofrecemos equipos de ingeniería de IA nearshore para organizaciones que necesitan implementar IA de producción rápidamente. Nuestros ingenieros trabajan desde Latinoamérica, alineados con las zonas horarias de EE. UU., y han colaborado con empresas como Twitter, Meta, Discovery Channel, Omnicom, UnitedHealth y CENTEGIX.
Buscamos perfiles senior con experiencia comprobada.
Requisitos básicos
- Más de 5 años de experiencia como Ingeniero DevOps, SRE o de sistemas administrando infraestructura de producción.
- Sólidos conocimientos en Linux, redes, Git y scripting (Bash, Python o Go).
- Experiencia profunda con Kubernetes en producción (provisionamiento, actualizaciones, depuración).
- Experiencia en Infraestructura como Código (Terraform o similar).
- Experiencia en la construcción y mantenimiento de pipelines CI/CD (GitHub Actions, GitLab o similar) y gestión de imágenes de contenedores.
- Experiencia en despliegue cloud en AWS, Azure o GCP, incluyendo servicios de Kubernetes gestionados y modelos de costos.
- Experiencia en monitoreo y gestión de incidentes (Datadog, CloudWatch o similar), con historial de resolución de incidentes de principio a fin.
- Experiencia en hardening de seguridad para Linux, contenedores y Kubernetes.
- Conocimiento en gestión de costos y capacidad de infraestructura.
- Uso activo de herramientas de codificación asistida por IA (Claude Code, Cursor, GitHub Copilot).
- Inglés técnico (escrito y hablado) nivel C1 o superior, con confianza para explicar decisiones técnicas a clientes.
- Título universitario en Ciencias de la Computación, campo relacionado, o experiencia profesional equivalente.
Requisitos
deseables
- Experiencia con Service Mesh (Istio, Linkerd o similar).
- Experiencia con Helm, Kustomize o herramientas de configuración de entornos.
- Experiencia en operaciones de bases de datos a escala de producción (PostgreSQL, MongoDB, RDS, DynamoDB o similar).
- Experiencia ejecutando o escalando cargas de trabajo de inferencia, y optimizando costos y latencia.
- Experiencia en entornos con regímenes de cumplimiento (SOC 2, HIPAA).
- Certificaciones cloud, contribuciones a proyectos open-source de infraestructura o publicaciones técnicas.
Beneficios
- Cultura 100% remota (trabajo desde cualquier lugar de Latinoamérica).
- Tiempo libre remunerado (PTO).
- Días festivos de EE. UU.
- Sólida capacitación y certificación en IA.
- Desarrollo profesional con mentoría.
- Participación en beneficios (Profit sharing).
- Remuneración en USD.
- Cobertura de maternidad.
Aplicá en https://azumo.com/join-our-team o escribinos a [email protected].