Todas as vagas
Operations
Senior Data & Platform Engineer – Veterinary Technology
Aceita BrasilLatAmRemoteFullTime
💵 Vaga remota para atuar com empresas dos EUA (modelo nearshore).
Sobre a vaga
Vaga remota para atuar com uma empresa dos EUA, no modelo nearshore (staff augmentation via Truelogic). O cliente é referência em tecnologia veterinária, com um ecossistema de software de gestão de clínicas, ferramentas de IA e apoio à decisão clínica usado por profissionais no mundo todo. Você será dono, de ponta a ponta, de uma plataforma de dados em rápido crescimento.
O que você vai fazer
- Assumir a responsabilidade completa pela confiabilidade da plataforma de dados: pipelines, data warehousing, transformações e observabilidade.
- Projetar e manter pipelines de dados robustos com Apache Airflow, orquestrando workflows em batch e near-real-time.
- Gerenciar e otimizar o data warehouse principal em Snowflake (design de schema, clustering keys, materialized views, controle de acesso e governança de custos).
- Construir e manter a camada de transformação em dbt (modelagem, estratégias incrementais, gestão de dependências e documentação).
- Fazer deploy e operar serviços da plataforma em Kubernetes (EKS), debugando pods e ajustando recursos.
- Provisionar e gerenciar a infraestrutura da plataforma (recursos de Snowflake e Airflow) usando Terraform.
- Escrever SQL e Python de alta qualidade para ETL, lógica de pipelines e entrega de data products.
- Gerenciar PostgreSQL como banco operacional de source-of-truth (otimização de queries, indexação, replicação e migrations).
- Liderar a transição para change data capture (CDC) na ingestão de dados, com ferramentas como Debezium.
- Implementar observabilidade, tracking de SLA e alertas com Datadog.
- Manter pipelines de CI/CD para deploy de DAGs, execuções de dbt, migrations de schema e builds de imagens.
- Colaborar com times de analytics, produto e full-stack para modelar data products limpos e bem documentados.
- Operar ambientes AWS (incluindo RDS e S3) para gerenciar serviços, ler logs e ajustar escalonamento.
Requisitos
- 5+ anos em data engineering ou em função combinada de dados e infraestrutura, com histórico comprovado de construir plataformas de dados de produção do zero.
- Domínio profundo de Snowflake (design de schema, tuning de performance, controle de acesso e otimização avançada de custos).
- Experiência prática forte com dbt (padrões de modelagem, estratégias incrementais, testes) e Airflow (escrever DAGs, gerenciar dependências, debug).
- Proficiência avançada em SQL e boa base de programação em Python para ETL e automação.
- Conhecimento prático de Kubernetes (deploy de workloads, leitura de logs de pods, gestão de Helm charts de forma autônoma).
- Experiência sólida com Terraform para provisionamento de infraestrutura, especialmente de componentes de plataforma de dados.
- Experiência prática com Datadog para observabilidade, monitoramento e visibilidade de SLA.
- Familiaridade com serviços AWS ligados a dados, como RDS e S3.
- Fluência no uso de assistentes de desenvolvimento baseados em IA para escrever, revisar e debugar código.
Diferenciais
- Experiência com Amazon Redshift.
- Familiaridade com infraestrutura de streaming (Kafka, Flink) ou open table formats (Iceberg, Delta Lake) — altamente valorizado.
- Experiência com Elixir ou Erlang.
- Conhecimento de ferramentas de data quality, cataloging ou lineage (Great Expectations, Soda, Monte Carlo, DataHub, OpenMetadata).
- Experiência prática com Debezium ou CDC equivalente, especialmente em produção.
- Experiência gerenciando EKS Spot instances em escala.
- Vivência em saúde, medicina veterinária ou domínios regulados que exigem rigor de precisão e auditabilidade de dados.
O que oferecem
- Trabalho 100% remoto.
- Pagamento em USD, com remuneração competitiva acima da média de mercado.
- Paid Time Off (PTO).
- Autonomia para gerir seu tempo, com foco em resultados.
- Projetos de alto impacto com empresas americanas líderes de mercado.