- Experiência com PHP em desenvolvimento e manutenção de aplicações web;
- Bancos de dados relacionais com MySQL: modelagem, SQL avançado e otimização de consultas, com volume relevante de dados;
- Vivência prática com rotinas de ETL e integração via APIs: da extração na origem até o dado pronto para ser consultado;
- Familiaridade com Git e Docker, e cabeça aberta para tecnologias fora do PHP: nossas origens de dados incluem SQL Server, Oracle, planilhas e sistemas legados, e nossos processos usam Python e Go em pontos específicos. Não esperamos domínio de tudo, e sim disposição para entrar nesses ambientes;
- Desejável: Python aplicado a extração e tratamento de dados; contato com bancos não relacionais (Elasticsearch/OpenSearch, MongoDB ou equivalentes); React e TypeScript para apoiar o front-end; uso de IA no dia a dia de desenvolvimento (Codex, Cursor, Copilot ou similares).
Buscamos alguém com gosto real por dados, autonomia para pegar um problema e desdobrá-lo, e vontade de crescer
- Manter as bases de referência de engenharia do eCustos atualizadas: entender como cada estado disponibiliza suas tabelas de preços, composições e insumos e trazer esses dados para o nosso padrão da forma mais rápida e confiável possível;
- Desenvolver e manter os conectores e rotinas de ETL que extraem dados de origens muito diferentes entre si (bancos relacionais, APIs, planilhas, arquivos), com rastreabilidade, tratamento de falhas e reprocessamento;
- Estruturar e modelar os dados para consumo pela aplicação: formatos, chaves de relacionamento e critérios de qualidade, investigando divergências entre as bases de origem;
- Trabalhar no back-end de processamento em PHP, incluindo as rotinas que rodam em background, e dar apoio nas interfaces de consulta e acompanhamento das cargas;
- Propor melhorias nos processos de extração usando IA (matching de composições e insumos, leitura de documentos não estruturados, normalização de descrições e detecção de anomalias).