ÜMA Puma
ÜMA Health
Careers
Ver vacantes
← Volver a vacantes

DevOps Sr

Tecnología · Remoto
Descripción
En ÜMA estamos acelerando nuestra ingeniería con Inteligencia Artificial, automatización y una arquitectura cloud moderna. Buscamos un DevOps Senior que impulse la evolución de nuestra plataforma tecnológica, garantizando que cada despliegue sea seguro, escalable, automatizado y altamente disponible. Una parte central de esta misión es construir y operar la capa de observabilidad y gobernanza de los agentes de IA de ÜMA: que cada agente en producción sea observable (sabemos qué hizo, con qué costo y con qué calidad), evaluable (podemos medir y regresionar su comportamiento ante cada cambio) y gobernable (con guardrails, control de acceso de mínimo privilegio y human-in-the-loop donde haya riesgo). En una plataforma de salud, esa trazabilidad y ese control no son opcionales. Buscamos un ingeniero que piense la plataforma como un producto, que combine automatización, observabilidad, seguridad y experiencia del desarrollador para que nuestros equipos, humanos y agentes, puedan construir y operar software más rápido, con mayor confiabilidad y menor fricción.
Responsabilidades
📌Observabilidad end-to-end: métricas, logs, trazas distribuidas y alertas que permitan detectar incidentes antes de que impacten al usuario, extendidas a los sistemas de IA y agentes (trazas de ejecución, costos, latencia y señales de calidad). 📌Gobernanza de agentes de IA (LLMOps / AI Governance): infraestructura para que los agentes sean observables, evaluables y gobernables: evals, guardrails, trazabilidad de acciones y human-in-the-loop. 📌Infrastructure as Code (IaC): automatización completa de infraestructura mediante Terraform, Ansible y prácticas GitOps. 📌Platform Engineering: construcción de plataformas internas que permitan a los equipos desplegar software de forma autónoma, segura y estandarizada. 📌DevSecOps: integración de controles de seguridad durante todo el ciclo de desarrollo mediante security gates, análisis automatizados y políticas de infraestructura. 📌Cloud Native: diseño de arquitecturas desacopladas, resilientes y escalables utilizando Kubernetes, contenedores y servicios administrados de Google Cloud Platform. 📌Reliability Engineering (SRE): automatización operativa, mejora continua, gestión de incidentes, post-mortems y reducción sistemática del error humano.
Requisitos
🚀 Experiencia: +5 años en roles de DevOps, Platform Engineering, SRE o Cloud Infrastructure, trabajando con entornos productivos críticos, escalables y de alta disponibilidad. 🚀 Cloud & Kubernetes: experiencia avanzada en GCP, Kubernetes/GKE, Docker y servicios cloud. Conocimientos sólidos de networking, IAM y seguridad cloud.  🚀 Observabilidad: experiencia excluyente diseñando observabilidad end-to-end con herramientas como OpenTelemetry, Prometheus, Grafana, ELK y Cloud Monitoring/Logging, incluyendo trazas, SLIs/SLOs y alertas.  🚀 IA / LLMOps: conocimientos de observabilidad y gobernanza de sistemas de IA o agentes. Se valora experiencia con herramientas como Langfuse, LangSmith, Arize Phoenix, Helicone u OpenLLMetry.  🚀 CI/CD & IaC: experiencia con Terraform, Ansible y pipelines CI/CD (GitLab CI, Jenkins, ArgoCD o GitHub Actions).  🚀 Automatización & DevSecOps: conocimientos de scripting (Shell/Python), gestión de secretos, vulnerability scanning, security gates y buenas prácticas de seguridad. 🚀 Seguridad y compliance: experiencia aplicando mínimo privilegio, cifrado y trazabilidad de accesos. Se valora conocimiento de normativas de protección de datos y salud (Ley 25.326, HIPAA o GDPR).
Aplicar a esta vacante