Workcofy
← Todas las oportunidades

Analista de Observabilidad y Operaciones TI

RiskAmerica

IA
EmpleoRemotoSemi seniorIngeniería
Ubicación
Remoto
Salario
USD 1,500 – 2,000
Publicada
Hace 1 mes
Fuente
Get on Board
Ver oportunidad en Get on BoardLa postulación se realiza en el sitio original.

Que necesitamos de ti Buscamos un/a profesional que mantenga el foco en la operación segura y confiable de nuestros sistemas, con habilidades para observar, detectar y actuar ante anomalías. Valoramos la capacidad de análisis para interpretar logs y contribuir al diagnóstico de fallas, además de la disciplina operativa para seguir jobs, procesos batch y workers. Se espera que: • Seas egresada o egresado de Ingeniería Informática o carrera afín, o cuentes con formación técnica equivalente. • Experiencia en monitoreo de infraestructura y aplicaciones en entornos cloud (Grafana, Prometheus u otras). • Experiencia usando Linux como sistema operativo de servidores. • Experiencia configurando alertas automatizadas y notificaciones push. • Experiencia gestionando o dando seguimiento a procesos batch y jobs programados. • Capacidad de definir umbrales y reglas de detección de anomalías. • Experiencia con herramientas de tickets/incidentes (GLPI, GitLab, Jira u otras). • Leer en inglés sin Google Translator ni IA. • Se requiere al menos 2 años de experiencia en roles similares. También buscamos buenas habilidades de comunicación, trabajo colaborativo y orientación a la mejora continua para incrementar la visibilidad de los sistemas y reducir la recurrencia de fallas.

Que harás con nosotros • Monitorear disponibilidad, rendimiento y estado de la infraestructura y aplicaciones en la nube. • Configurar y mantener alertas automatizadas con notificación push ante anomalías (por ejemplo, Slack, PushOver, SNS u otras). • Dar seguimiento a jobs, procesos batch y workers, asegurando su correcta ejecución. • Analizar logs operacionales para el diagnóstico de fallas. • Construir y mantener tableros de control (dashboards). • Monitorear servicios de alta disponibilidad (uptime, failover, health checks). • Escalar incidentes operativos de forma oportuna según su criticidad. • Colaborar con equipos técnicos para resolver incidencias y mejorar la observabilidad de los sistemas.

Sumas puntos si • Experiencia trabajando con herramientas y canales de notificación como Slack, PushOver, Amazon SNS u otros mecanismos equivalentes. • Conocimiento de procesos batch y ejecución de workers en entornos de nube. • Experiencia mejorando observabilidad end-to-end (métricas, logs y alertas) mediante mejoras incrementales. • Cuentas con experiencia en la industria financiera o en compañías de infraestructura de mercado (FMI, AFP, bolsas, DCV u otro). • Conocimientos básicos de scripting (Python, Bash) para automatizar chequeos. • Experiencia integrando sistemas de monitoreo con herramientas de mensajería (webhooks, APIs). • Conocimientos de plataformas cloud (GCP). • Conocimientos de Seguridad TI.

cloud monitoringlinuxbatch processinglog analysisincident managementscriptingsecurityalertingdashboardingticketing systems