Antes de continuar clique no botão abaixo
Engenheiro de Dados Sênior - São Paulo/SP
* Atenção, candidato! O Sírio-Libanês NÃO solicita dados pessoais (documentos, dados bancários) ou pagamentos por WhatsApp, telefone, e-mail ou redes sociais. Nosso único canal oficial para inscrições é o site do Hospital Sírio-Libanês, na seção 'Trabalhe Conosco'.
É uma Pessoa com Deficiência? Esta vaga também é para você!
Olá, somos o Sírio-Libanês!
Somos uma instituição de saúde centenária, que através da sua atuação em mais de 60 especialidades, tem como propósito levar vida plena e digna a um número cada vez maior de pessoas. A cada ano, contribuímos para a formação de profissionais da saúde e atendemos milhares de pacientes.
Nos orgulhamos do nosso caráter filantrópico, de um compromisso social genuíno e de sermos uma das melhores instituições de saúde do mundo reconhecida pela revista Newsweek (2023) além de sermos uma empresa TOP Employers, nos destacando entre as melhores instituições do mundo em práticas de Recursos Humanos.
Desta maneira, acreditamos que a diversidade é fator fundamental que molda a nossa cultura. Venha com a gente nessa jornada por mais inclusão, diversidade, equidade, representatividade e proporcionalidade.
Queremos você para fazer parte dessa história!
Nesta posição você será responsável pelo:
-
Projetar, desenvolver, manter e evoluir pipelines de dados robustos e escaláveis utilizando Databricks;
-
Atuar na definição e evolução da arquitetura de dados, considerando aspectos de escalabilidade, performance, disponibilidade, segurança e custos;
-
Desenvolver soluções de processamento e transformação de dados utilizando PySpark, Python e SQL;
-
Construir e evoluir soluções utilizando Delta Lake, arquitetura Lakehouse e recursos do ecossistema Databricks;
-
Desenvolver e otimizar processos de ingestão, transformação e disponibilização de dados, incluindo cargas batch e, quando aplicável, streaming;
-
Projetar e implementar modelos de dados analíticos, considerando diferentes necessidades de consumo e camadas de dados;
-
Analisar e otimizar performance de pipelines, consultas, jobs e recursos computacionais, buscando eficiência e controle de custos;
-
Implementar e evoluir práticas de qualidade, observabilidade, monitoramento e confiabilidade dos pipelines e produtos de dados;
-
Atuar na definição e aplicação de padrões de desenvolvimento, versionamento, testes, segurança, governança e documentação;
-
Trabalhar com Git e CI/CD, promovendo práticas de engenharia e automação no ciclo de desenvolvimento;
-
Investigar e solucionar problemas complexos relacionados a pipelines, processamento, integração e disponibilização de dados;
-
Atuar de forma próxima às áreas de negócio, traduzindo necessidades em soluções de dados sustentáveis e escaláveis;
-
Apoiar decisões técnicas e contribuir para a evolução da arquitetura e dos padrões utilizados pelo time;
-
Compartilhar conhecimento e atuar como referência técnica para profissionais menos experientes;
-
Identificar oportunidades de automação, simplificação e melhoria contínua dos processos e da plataforma de dados.
Para esta posição é essencial ter:
-
Ensino Superior Completo em Tecnologia, Engenharia, Ciência da Computação, Estatística ou áreas relacionadas;
-
Experiência sólida em Engenharia de Dados, atuando no desenvolvimento e evolução de pipelines e soluções de dados;
-
Experiência prática com Databricks e arquitetura Lakehouse;
-
Domínio de PySpark, Python e SQL;
-
Experiência com Delta Lake e processamento de grandes volumes de dados;
-
Conhecimento de arquitetura e modelagem de dados, incluindo modelos dimensionais, fatos e dimensões;
-
Experiência com ambientes de nuvem, preferencialmente AWS, incluindo serviços como S3, Glue, Athena, Redshift e/ou serviços relacionados;
-
Experiência com ferramentas de orquestração, como Databricks Workflows, Airflow ou similares;
-
Conhecimento de Git, CI/CD e práticas de desenvolvimento de software;
-
Conhecimento de conceitos de qualidade, governança, segurança, observabilidade e linhagem de dados;
-
Capacidade de analisar problemas complexos, identificar causas e propor soluções técnicas;
-
Capacidade de atuar com autonomia, tomar decisões técnicas e trabalhar em conjunto com diferentes áreas;
-
Boa comunicação, organização e capacidade de compartilhar conhecimento.
Diferenciais:
-
Experiência com Unity Catalog e governança de dados no Databricks;
-
Conhecimento de Databricks SQL, Workflows e Delta Live Tables/Lakeflow;
-
Experiência com processamento streaming/CDC;
-
Conhecimento de arquitetura orientada a eventos;
-
Experiência com Terraform ou infraestrutura como código;
-
Conhecimento de práticas de FinOps aplicadas a plataformas de dados;
-
Experiência com APIs e integração entre diferentes fontes e sistemas;
-
Certificações Databricks ou experiência equivalente comprovada.
Local de trabalho: Unidade Bela Vista
Modelo de Trabalho: Híbrido
Tipo de Contrato: Efetivo
Horário: 08h às 17h48
Para que possamos nos conhecer melhor, teremos as seguintes etapas:
-
Inscrição pelo sistema SAP e confirmação via e-mail
-
Análise de currículo
-
Entrevista com Atração de Talentos e Gestor
Confira os benefícios que temos por aqui:
Para cuidar da sua saúde e da sua família:
-
Assistência Médica
-
Programa Cuidando de Quem Cuida
-
Assistência Odontológica
-
Convênio Farmácias
-
Seguro de vida
-
Auxílio-Creche
-
Desconto em vacinas
Para cuidar de você:
-
Programa Recarrega
-
Convênio Academias
-
Vale Alimentação
-
Vale Refeição ou Refeitório no local*
-
Auxílio home-office*
-
Clube de Beneficios (parcerias e promoções)
-
Vale Transporte
*Os benefícios podem sofrer alteração de acordo com a convenção coletiva, jornada de trabalho, políticas internas vigentes e unidade de trabalho.