Foto de Cezar Augusto Roggia

SRE · Cloud · DevOps · Platform Engineering

Cezar Augusto Roggia

Computer Engineering | AIOps | SRE, DevOps & Platform Engineering Specialist

Computer Engineering | AIOps | AWS · EKS · Kubernetes · Terraform · GitOps · Observability | DevSecOps | Incident Response & Cloud Platform

Observabilidade em tempo real

Diagnóstico em Tempo Real

Este site é uma demonstração viva de Observabilidade e SRE: no momento em que você chegou, capturamos telemetria do seu ambiente com OpenTelemetry — traces, métricas e logs — exatamente como em uma plataforma enterprise de produção.

Estabelecendo conexão segura…

analisando ambiente…0%
Estabelecendo conexão segura
Analisando ambiente do navegador
Medindo latência e desempenho
Detectando hardware e capacidades gráficas
Coletando Web Vitals em tempo real
Gerando análise inteligente com IA

Sobre mim

Resumo executivo do perfil profissional.

Atuo há mais de 18 anos em TI, com foco nos últimos 10+ anos em Cloud, Kubernetes, automação, observabilidade e plataformas de missão crítica. Minha experiência está concentrada em ambientes de alto volume transacional, alta disponibilidade e operação crítica, onde infraestrutura precisa ser escalável, resiliente, segura e observável.

Participei de projetos para empresas como Alelo, PagSeguro, Itaú, MPSC, TJSC, FirstData, Banco do Brasil, Bradesco, Capgemini e Solides, em iniciativas de modernização, cloud, infraestrutura como código, CI/CD, monitoramento, incidentes, arquitetura e confiabilidade operacional.

Tenho atuado na aplicação prática de AIOps e IA generativa em observabilidade, incluindo assistentes integrados ao Grafana para análise de métricas e soluções capazes de analisar logs, identificar erros e melhorias, gerar resumos técnicos e abrir automaticamente cards para times de produto.

Sou uma pessoa técnica, analítica e prática, orientada a resolver problemas, com visão crítica, senso de dono e foco em melhoria contínua. Além da atuação técnica, já palestrei em eventos como CloudUP e ministrei treinamentos de Kubernetes, Rancher, Ansible e Terraform.

Experiência profissional

Mais de 18 anos em TI, com 10+ anos dedicados a Cloud, Kubernetes e confiabilidade.

  1. SRE / Platform Engineer

    SolidesOut 2023 — atual
    • Liderança técnica de iniciativas de confiabilidade, observabilidade, AIOps e infraestrutura em nuvem.
    • Plataforma Kubernetes multi-empresa com redução de 70% no tempo de provisionamento.
    • Observabilidade unificada (logs, métricas, tracing e profiling) para todo o ecossistema.
    AWSEKSTerraformArgoCDSigNozOpenTelemetry
  2. Site Reliability Engineer

    Capgemini (Banco do Brasil)Ago 2022 — Ago 2024
    • Responsável técnico pela implementação de SRE e Observabilidade no Banco do Brasil.
    • Dashboards, testes de performance e análise de desempenho de clusters Kubernetes.
    • Definição de arquitetura computacional no Banco do Brasil e Bradesco.
    KubernetesSREObservabilityDevOps
  3. Architect Lead SRE

    NTT DATA Europe & LATAMJan 2022 — Jul 2022
    • Liderei a equipe de SRE/DevOps em iniciativas de arquitetura e confiabilidade para ambientes cloud native.
    • Apoio na definição de práticas SRE, automação, observabilidade e padronização operacional.
    • Projeto posteriormente suspenso por decisão organizacional.
    AWSAzureSREKubernetesObservabilityDevOps
  4. Especialista DevOps/SRE

    Conductor (Meios de Pagamento)Jan 2021 — Fev 2022
    • Padronização e arquitetura de serviços de infraestrutura para times de desenvolvimento.
    • Gestão de custos cloud e automação de resolução de incidentes.
    JenkinsAnsibleTerraformKubernetesAzureSplunk
  5. Especialista SRE/DevOps

    Conta AzulSet 2020 — Jan 2021
    • Desempenho, escalabilidade e disponibilidade; RCA e postmortems.
    • PostgreSQL, AWS, telemetria centralizada com Prometheus/Grafana.
    AWSPostgreSQLPrometheusKubernetes
  6. DevOps Architect Senior

    Iteris (Alelo, PagSeguro/PagBank)Nov 2019 — Set 2020
    • Automação GitOps de Terraform e Ansible com Azure DevOps na Alelo.
    • SRE/DevOps no PagBank: plataforma de microsserviços e monitoração proativa.
    TerraformAnsibleAzure DevOpsAWSRancher
  7. Analista de Infraestrutura/DevOps

    SocialBaseMai 2019 — Nov 2019
    • Kubernetes em alta disponibilidade com Rancher e Kops em múltiplas contas AWS.
    AWSKubernetesRancherCI/CD
  8. Analista de Infraestrutura TI/Cloud

    Cresol ConfederaçãoNov 2018 — Abr 2019
    • Migração de VMs para contêineres com Kubernetes/Rancher e CI/CD.
    KubernetesDockerJenkinsIBM Cloud
  9. Analista de Infraestrutura

    Audora (MPSC, TCE-AL, DPE-PR)Fev 2018 — Mar 2019
    • Infraestrutura de órgãos públicos; monitoramento com Prometheus/Grafana.
    • Instrutor de Docker, Rancher e Segurança Linux para equipes governamentais.
    RancherDockerAWSGitLab CI
  10. SysAdmin Linux

    Endurance International GroupAgo 2016 — Abr 2018
    • Webhosting em larga escala: e-mail, DNS, bancos, WHM/cPanel, firewall e VPN.
    LinuxBashcPanelApache
  11. Técnico de Infraestrutura de TI

    LabTransMai 2014 — Mai 2016
    • Servidores Windows/Linux, virtualização VMware/Hyper-V, Zabbix e bancos de dados.
    Windows ServerVMwareZabbixPostgreSQL

Competências

Tecnologias e habilidades agrupadas por categoria.

Cloud & Infrastructure

AWSEKSAzureGCPOCIVPC/IAM/IRSALinux (LPIC-1)FinOpsRedes & VPN

Kubernetes & Containers

KubernetesAmazon EKSMulti-clusterDockerHelmRancherStatefulSetsTaints/Labels

SRE & Observability

PrometheusThanosGrafanaSigNozOpenTelemetryClickHouseIncident ResponseRCA/PostmortemsCapacity Planning

DevOps & Automation

TerraformAnsiblePythonShell ScriptIaCGitOpsPuppet

Databases & Stateful

PostgreSQL/RDSClickHouseMySQLMongoDBRedisKafkaRabbitMQBackup/Recovery

CI/CD & GitOps

ArgoCDAzure DevOpsJenkinsGitLab CIGitHubCircleCIGitFlow

Soft Skills

Liderança técnicaMentoriaComunicaçãoInstrutor/PalestranteSenso de donoScrum

Projetos relevantes

Evolução de observabilidade, plataformas cloud native, GitOps e automação de infraestrutura.

AIOps Assistant para Observabilidade — ElasticSearch, Thanos, Grafana, AWS Bedrock e Lambda

2026 — Atual · Solides

Assistente de observabilidade com IA generativa integrado ao Grafana, utilizando AWS Bedrock e AWS Lambda para análise de métricas, logs e dados de monitoramento. Permite interação em linguagem natural com fontes como Thanos, Elastic, Azion e AWS, apoiando troubleshooting, incident response e correlação de sinais em ambientes cloud native.

AIOpsGrafanaAWS BedrockAWS LambdaThanosElasticSearchAzionAWSIncident Response

Log Intelligence com IA para Detecção de Erros e Criação Automática de Cards

2025 — Atual · Solides

Solução de AIOps para análise automatizada de logs, identificação de erros, anomalias, falhas recorrentes e oportunidades de melhoria. A IA interpreta sinais operacionais, gera resumo técnico e cria cards acionáveis no board do time de produto, conectando observabilidade, SRE, incident response e melhoria contínua.

AIOpsLog IntelligenceIA GenerativaObservabilitySREAutomationIncident ResponseTroubleshootingProduct

Multi-Clusters EKS na AWS

2025 — 2026 · Solides

Arquitetura e evolução de plataforma Kubernetes multi-cluster EKS com isolamento de workloads, GitOps, segurança IAM/IRSA e observabilidade.

AWSEKSTerraformHelmArgoCDIRSA

Observabilidade com SigNoz, OTel e ClickHouse

2026 · Solides

Plataforma corporativa de observabilidade cloud native: traces, logs e métricas centralizados com SigNoz, OpenTelemetry Collector, ClickHouse e PostgreSQL/RDS.

SigNozOpenTelemetryClickHousePostgreSQLGitOps

GitOps para Plataforma SRE em EKS

2025 · Solides

Implantação do zero de GitOps com ArgoCD para workloads de plataforma: syncPolicy automatizado, selfHeal, prune, rollback e governança de mudanças.

ArgoCDHelmTerraformKubernetes

Observabilidade Prometheus + Thanos multi-cloud

2024 — 2025

Stack corporativa de monitoramento com Prometheus, Thanos, Grafana e Alertmanager: métricas, dashboards e alertas centralizados para múltiplos ambientes.

PrometheusThanosGrafanaAlertmanager

Arquitetura Cloud Azure Multi-Região com IaC, Terraform e Terragrunt

2021 · Conductor

Arquitetura cloud complexa na Azure, estruturada em modelo multi-account/multi-subscription, multi-ambiente e multi-região. Foco em infraestrutura como código com Terraform e Terragrunt, criando uma base modular, reutilizável e governável para provisionamento, padronização, segurança e evolução controlada da infraestrutura.

AzureTerraformTerragruntIaCCloud ArchitectureCloud GovernanceMulti-RegionAutomationPlatform Engineering

Automação Ansible/Terraform GitOps (Alelo)

2019 — 2020 · Iteris

Automação declarativa com pipelines Azure DevOps, execução por tags, Cross-Account/Roles em AWS e extensão Python para assume-role no Ansible.

AnsibleTerraformAzure DevOpsAWS

SRE & Observability — Banco do Brasil

2022 — 2024 · Capgemini

Implementação de práticas SRE e observabilidade, testes de performance e análise de clusters Kubernetes. Meetup interno sobre princípios de Observabilidade.

SREKubernetesObservability
Currículo Interativo com IA

Converse com a IA do Currículo

Uma assistente de carreira para recrutadores e gestores avaliarem, em segundos, a experiência, os projetos e as competências técnicas de Cezar Augusto Roggia.

IA do Currículo · Cezar Augusto Roggia

Online

👋 Olá! Sou a IA que representa o perfil profissional de Cezar Augusto Roggia.

Me pergunte sobre minha trajetória, experiências, projetos, competências técnicas e tecnologias que utilizo.

Sugestões para avaliar o perfil

Enter para enviar • Shift+Enter para nova linha • Respostas baseadas apenas na base pública do currículo.