Quiénes somos
En Network Solutions, confiamos desde hace décadas en ayudar a las personas a conectarse y a mantenerse a la vanguardia. Hemos estado aquí desde el principio de Internet y seguimos construyendo para lo que viene. Como la autoridad original de identidad digital, ayudamos a asegurar nombres de dominio, proteger marcas y salvaguardar la infraestructura de la que dependen las empresas. Capacitamos a nuestros clientes para que posean y administren los activos que los definen en línea, al tiempo que brindamos seguridad de nivel empresarial para proteger contra amenazas virtuales. Nuestro equipo aprovecha herramientas modernas aceleradas por IA para optimizar la forma en que las empresas administran su presencia digital, aprovechando al máximo nuestras décadas de experiencia. El equipo de Network Solutions está aquí para ayudar a las empresas en línea a proteger lo que es suyo y construir para el futuro. Es por eso que millones confían en nosotros para proteger sus dominios, marcas y sitios web todos los días.
El impacto que tendrás
Buscamos un Ingeniero DevOps Senior práctico para construir y operar la infraestructura que potencia nuestras plataformas de IA, entornos de ejecución de agentes, aplicaciones web, servicios de backend, APIs y capacidades de plataforma compartida. Nuestro entorno incluye una puerta de enlace centralizada de LLM, entornos de ejecución de agentes basados en Python, trabajadores RAG, servicios MCP, procesamiento asíncrono, bases de datos, cachés, colas y servicios de observabilidad. Trabajarás con ingenieros de IA, ingenieros de aplicaciones y arquitectos que definen diseños técnicos, y luego traducirás de forma independiente esos diseños en infraestructura de producción confiable, escalable, segura y observable en Microsoft Azure y Oracle Cloud Infrastructure.
Lo que harás
- Traducir diseños técnicos de aplicaciones y plataformas en infraestructura en la nube lista para producción con mínima supervisión.
- Diseñar, aprovisionar, operar y solucionar problemas de entornos Kubernetes, principalmente Azure Kubernetes Service y Oracle Kubernetes Engine.
- Dar soporte a cargas de trabajo de IA, incluyendo puertas de enlace basadas en LiteLLM, entornos de ejecución de agentes Python, trabajadores RAG, servicios MCP, trabajadores en segundo plano y canalizaciones de procesamiento asíncrono.
- Diseñar y administrar redes de entrada y salida, balanceadores de carga, DNS, TLS, conectividad privada, enrutamiento, NAT, firewalls, políticas de red y comunicación de servicio a servicio.
- Construir y operar infraestructura para aplicaciones web y servicios de backend, incluyendo APIs, bases de datos, cachés, colas, trabajos programados y cargas de trabajo impulsadas por eventos.
- Construir y mantener canalizaciones de CI/CD usando Jenkins y Bitbucket, integrando Docker, Helm, Kubernetes, ArgoCD y registros de contenedores.
- Automatizar el aprovisionamiento y la configuración de infraestructura usando Terraform, Helm, manifiestos de Kubernetes, Python, Bash y herramientas relacionadas.
- Implementar observabilidad de extremo a extremo utilizando métricas, registros, rastreo distribuido, paneles, alertas, verificaciones de estado y SLOs.
- Ser responsable de la preparación para producción, la solución de problemas de incidentes, el análisis de causa raíz, la escalabilidad, la confiabilidad y la optimización de costos de infraestructura.
- Crear patrones de infraestructura reutilizables que permitan a los equipos de ingeniería lanzar nuevos servicios de manera rápida y consistente.
Lo que buscamos
- 7 o más años de experiencia en DevOps, SRE, Ingeniería de Plataformas, Infraestructura en la Nube o un rol relacionado.
- Sólida experiencia práctica operando entornos Kubernetes de producción y profundo conocimiento de redes, programación, almacenamiento, escalado automático, seguridad y solución de problemas.
- Sólida experiencia en Microsoft Azure, incluyendo AKS, redes, identidad, almacenamiento y monitoreo. Se prefiere experiencia en OCI, o capacidad demostrada para trabajar en múltiples proveedores de nube.
- Sólido conocimiento de redes en la nube, incluyendo redes virtuales, subredes, enrutamiento, NAT, balanceadores de carga, redes privadas, DNS, TLS, firewalls, entrada y salida.
- Sólida experiencia con Jenkins, Bitbucket, Docker, Terraform, Helm, Kubernetes e Infraestructura como Código.
- Experiencia comprobada en el soporte de aplicaciones web de producción y servicios de backend, incluyendo APIs REST, microservicios, trabajadores en segundo plano y arquitecturas asíncronas.
- Experiencia práctica con bases de datos, almacenamiento en caché y sistemas de mensajería como PostgreSQL, Redis, RabbitMQ o tecnologías equivalentes.
- Experiencia implementando observabilidad de producción usando OpenTelemetry, Grafana, Prometheus, Sentry, monitoreo en la nube o herramientas similares.
- Sólidas habilidades en Linux, sistemas y solución de problemas de producción.
Conocimiento de ingeniería de aplicaciones
No necesitas ser un desarrollador de aplicaciones a tiempo completo, pero debes comprender cómo funcionan los sistemas de backend modernos y ser capaz de solucionar problemas en los límites de la aplicación y la infraestructura.
- Conocimiento práctico de Python, especialmente servicios de backend construidos con frameworks como FastAPI.
- Familiaridad con al menos un lenguaje adicional como C#, Java, Go, JavaScript o TypeScript.
- Comprensión de HTTP, HTTPS, DNS, TCP/IP, proxies, autenticación, APIs, agrupación de conexiones, almacenamiento en caché, concurrencia, colas, reintentos, colas de mensajes fallidos y procesamiento asíncrono.
- Capacidad para leer registros de aplicaciones y traces de pila y diagnosticar problemas de latencia, memoria, CPU, conexión y dependencias.
Cómo trabajarás
Con frecuencia recibirás un diseño técnico para una nueva carga de trabajo de IA, aplicación, servicio de backend o capacidad de plataforma. A partir de ese diseño, deberías poder determinar de forma independiente e implementar la infraestructura necesaria para ejecutarla en producción.
- Determinar los recursos en la nube requeridos, la configuración de Kubernetes, los namespaces, el modelo de escalado y los servicios de soporte.
- Configurar la entrada y salida, la conectividad privada, el DNS, TLS, la comunicación de servicios, las identidades y los secretos.
- Aprovisionar y operar dependencias como PostgreSQL, Redis, RabbitMQ, almacenamiento y otros servicios compartidos.
- Construir el flujo de CI/CD de Jenkins y Bitbucket para compilación, prueba, publicación de contenedores, despliegue, validación y reversión.
- Definir la observabilidad, las verificaciones de estado, los paneles, las alertas, el monitoreo de capacidad y los runbooks operativos antes del lanzamiento a producción.
- Ser responsable de la entrega de infraestructura a través de UAT y producción, asociándose con arquitectos e ingenieros cuando los compromisos de diseño requieran discusión.
Lo que te hará destacar
- Experiencia en el soporte de plataformas de IA o aprendizaje automático, puertas de enlace LLM, entornos de ejecución de agentes, canalizaciones RAG o servicios MCP.
- Experiencia con Cloudflare, Envoy, ArgoCD, GitOps y OpenTelemetry.
- Experiencia en la construcción de plataformas de infraestructura reutilizables para aplicaciones SaaS de alta escala o orientadas al cliente.
- Experiencia operando sistemas de backend distribuidos utilizando RabbitMQ, Redis, PostgreSQL y tecnologías similares.
- La experiencia en infraestructura de IA o aprendizaje automático es útil, pero no obligatoria.
- Una sólida experiencia con Kubernetes, infraestructura web y de backend, redes, colas, bases de datos, CI/CD, observabilidad y operaciones en la nube de producción es la base para este rol.
#NetworkSolutions