Skip to main content
Experian

Analista de Observabilidade Sênior - Vaga Afirmativa para Mulheres

RemoteBrazil only
Published
Role
SRE
Experience
Senior
Employment
Full-time
Company size
Enterprise
Salary not disclosed
Check eligibility

Open to BR only. Set where you work from to check your eligibility.

No BS summary

Senior Observability Analyst with advanced Datadog experience needed to lead the organization's observability strategy. Must define standards, promote best practices, and ensure proactive implementation using metrics, logs, and traces. Requires strong technical knowledge in Datadog and ability to translate operational data into actionable improvements for user experience, application stability, and operational efficiency.

Core skills

Datadog

Required skills

Datadog APMDatadog Infrastructure MonitoringDatadog Logs ManagementDatadog DashboardsDatadog MonitorsMonitoring Service CatalogLogsMetricsDistributed TracingOpenTelemetryPythonShell ScriptPowerShellKubernetesDockerAWS

Optional skills

Datadog Certified AssociateDynatraceGrafanaPrometheusElastic StackZabbix

What you'll do

  • Atuar como referência técnica e funcional da plataforma Datadog dentro da organização.
  • Projetar, implementar e evoluir soluções de observabilidade utilizando os módulos de APM, Infrastructure Monitoring, Logs Management, Dashboards, Real User Monitoring (RUM), Synthetic Monitoring e Continuous Testing.
  • Definir padrões corporativos de observabilidade para aplicações, APIs, microsserviços e workloads em cloud.
  • Estruturar e manter dashboards executivos, operacionais e analíticos para acompanhamento da saúde das plataformas.
  • Desenvolver estratégias de monitoramento proativo baseadas em SLIs, SLOs, SLAs e indicadores de negócio.
  • Criar, revisar e otimizar monitores e alertas inteligentes utilizando recursos avançados do Datadog para redução de ruído operacional e falsos positivos.
  • Apoiar times de desenvolvimento na instrumentação de aplicações utilizando OpenTelemetry e integrações nativas do Datadog.
  • Conduzir análises de causa raiz (RCA) de incidentes críticos e propor ações estruturantes para evitar recorrências.
  • Identificar oportunidades de automação, predição de falhas e iniciativas de self-healing.
  • Desenvolver treinamentos, playbooks, padrões e documentações relacionados à plataforma Datadog.
  • Realizar análises periódicas de capacidade, performance, disponibilidade e experiência do usuário final.
  • Atuar como agente de transformação na disseminação da cultura de observabilidade e excelência operacional.

What they require

  • Formação superior completa em Ciência da Computação, Engenharia, Sistemas de Informação ou áreas correlatas.
  • Experiência avançada com Datadog, atuando tanto na implementação quanto na administração e evolução da plataforma.
  • Experiência prática com: Datadog APM Datadog Infrastructure Monitoring Datadog Logs Management Datadog Dashboards Datadog Monitors Monitoring Service Catalog
  • Conhecimento avançado dos pilares de observabilidade: Logs, Métricas, Tracing Distribuído
  • Experiência em observabilidade de APIs e arquiteturas de microsserviços.
  • Experiência com ambientes AWS.
  • Vivência em troubleshooting e investigação de incidentes complexos.
  • Conhecimento em OpenTelemetry e instrumentação de aplicações.
  • Conhecimento de automação utilizando Python, Shell Script ou PowerShell.
  • Experiência com Kubernetes, Docker e ecossistemas cloud-native.
  • Conhecimento sólido sobre disponibilidade, performance, escalabilidade e confiabilidade de sistemas.
  • Capacidade de traduzir indicadores técnicos em impactos para negócio.
  • Excelente comunicação e habilidade para atuar com múltiplos stakeholders.
  • Certificação Datadog Certified Associate ou superior.
  • Experiência com práticas de SRE (Site Reliability Engineering).
  • Experiência em implementação de estratégias de observabilidade para ambientes distribuídos de alta escala.
  • Conhecimento em CI/CD e DevSecOps.
  • Experiência com automação de resposta a incidentes e processos de self-healing.
  • Vivência em governança operacional, gestão de incidentes, Problem Management e processos ITIL.
  • Experiência prévia com ferramentas como Dynatrace, Grafana, Prometheus, Elastic Stack ou Zabbix.
  • Paixão por observabilidade e confiabilidade de sistemas.
  • Perfil investigativo e orientado à resolução de problemas complexos.
  • Forte senso de dono e responsabilidade operacional.
  • Capacidade de influenciar equipes técnicas na adoção de boas práticas.
  • Mentalidade orientada à dados e melhoria contínua.
  • Visão sistêmica para correlacionar eventos técnicos com impactos de negócio.
  • Perfil colaborativo, consultivo e com facilidade para capacitar outras equipes.

Benefits

  • Ser protagonista na definição da estratégia corporativa de observabilidade.
  • Atuar diretamente na evolução da maturidade operacional da organização.
  • Liderar iniciativas de automação, observabilidade inteligente e redução de incidentes.
  • Influenciar padrões de engenharia e confiabilidade utilizados por múltiplos times.
  • Trabalhar em um ambiente de alta visibilidade e impacto para o negócio.
  • Participar da construção de uma operação cada vez mais proativa, orientada por dados e baseada em excelência operacional.

Irish company that provides information services

🇮🇪 IrelandDataEnterpriseexperian.com/

What people say about this company

3.6/ 5

Salary not disclosed