BigData on-premise vs cloud — decisões de arquitectura
Como decidir entre um cluster Hadoop on-premise e soluções cloud como EMR, Dataproc ou Azure HDInsight — custos, controlo, e os trade-offs reais.
Como decidir entre um cluster Hadoop on-premise e soluções cloud como EMR, Dataproc ou Azure HDInsight — custos, controlo, e os trade-offs reais.
Os comandos Linux que uso diariamente como developer e engenheiro de dados: shell scripting, diagnóstico de sistemas, e configurações que aumentam a produtividade.
Window functions, CTEs recursivas e técnicas de optimização SQL que transformam análises complexas em queries elegantes e eficientes.
O que distingue um Engineering Manager de um Tech Lead, como os dois papéis se complementam, e o que aprendi na transição de engenheiro para gestor.
Como o YARN gere recursos em clusters Hadoop, as diferenças entre schedulers, e como configurá-lo para ambientes de produção multi-tenant.
Como construir aplicações PHP escaláveis em 2026 com Slim 4, arquitectura modular e auto-discovery de rotas — sem frameworks pesados.
Como capturar mudanças de base de dados MySQL em tempo real com Maxwell Daemon e publicar no Kafka para alimentar pipelines downstream.
Comparação prática entre PrestoDB e Spark SQL: diferenças de arquitectura, casos de uso ideais e como escolher a ferramenta certa para cada problema.
Guia prático sobre Apache Kafka: partições, consumer groups, garantias de entrega e os padrões que realmente funcionam em produção.
Uma análise honesta de por que Scala e Akka continuam a ser a escolha certa para sistemas BigData de alta escala em ambientes de produção exigentes.