Dados e analytics
Senior Data Engineer - Azure, Databricks & ML Pipelines | Remote - vaga remota
Toptal
Senior Data Engineer - Azure, Databricks & ML Pipelines | Remote - Dados e analytics, remoto
A empresa Toptal está com uma vaga aberta de Senior Data Engineer - Azure, Databricks & ML Pipelines | Remote: nível senior, ou seja, a empresa espera que você tome as decisões. A posição fica na área de Dados e analytics e é totalmente remota. A empresa não impõe restrição sobre onde o candidato mora, então você pode se candidatar de onde estiver.
As principais ferramentas citadas no anúncio são: Python, SQL, Machine Learning. O currículo precisa mostrar exemplos concretos exatamente dessas habilidades.
A empresa não publicou nenhum valor, isso é acertado na entrevista. O anúncio não impõe condição nenhuma de horário.
Esta vaga passou por uma verificação automática: anúncios que exigem autorização de trabalho estrangeira, patrocínio de visto, uma nacionalidade específica ou residência em um país indicado não entram na lista.
Ferramentas
Em resumo
- Empresa
- Toptal
- Área
- Dados e analytics
- Quem pode se candidatar
- De qualquer país do mundo
- Formato de trabalho
- Totalmente remota
- Nível
- Senior
- Ferramentas
- Python, SQL, Machine Learning
- Publicada
- 29 de julho de 2026 (há 28 dias)
- Ativa
- até 7 de setembro de 2026
- Fonte
- We Work Remotely
Novas vagas de Dados e analytics por e-mail
O quadro é atualizado várias vezes por dia. Só escrevemos quando aparece uma vaga nova e já verificada. Sem spam e sem precisar de conta.
Já assinou? Gerenciar as configurações
Descrição da empresa
Headquarters: Remote
URL: https://www.toptal.com/
About the Role
We're looking for a Senior Data Engineer to design, build, and maintain scalable data pipelines and ML-ready infrastructure on Azure and Databricks. This is a hands-on engineering role: you'll own the full data pipeline lifecycle - ingestion, transformation, orchestration, and deployment - while supporting machine learning workflows with clean, reliable data. If you're comfortable owning infrastructure decisions and writing production-quality Python at scale, this role is built for that.
What You'll Do
* Design, build, and maintain data pipelines using Databricks and Azure-native data services
* Develop and optimize ETL/ELT processes to support analytics and machine learning workloads
* Build and maintain CI/CD pipelines for data engineering and ML deployment workflows
* Write clean, efficient, production-quality Python for data processing and pipeline automation
* Support machine learning teams with well-structured, high-quality datasets and feature pipelines
* Design and manage data architecture across Azure services (e.g., Azure Data Factory, Azure Data Lake, Azure Synapse)
* Monitor pipeline performance, troubleshoot data quality issues, and implement reliability improvements
* Implement data governance, security, and access control best practices
* Collaborate with data scientists, analysts, and software engineers to align data infrastructure with business needs
* Participate in code reviews, architecture discussions, and technical planning
What You Bring
* Strong hands-on experience with Azure cloud data services
* Proven experience building and maintaining pipelines on Databricks
* Solid experience designing and managing CI/CD pipelines for data or ML workflows
* Strong Python skills for data engineering and pipeline development
* Working knowledge of machine learning workflows and how data engineering supports them
* Experience with SQL and relational/distributed data systems
* Understanding of data pipeline orchestration, monitoring, and reliability practices
* Strong problem-solving skills and ability to work independently on complex data infrastructure challenges
* Solid communication skills for collaborating with data science and engineering teams
Nice to Have
* Experience with MLOps practices and tools (MLflow, Azure ML)
* Familiarity with Spark internals and performance tuning within Databricks
* Experience with infrastructure-as-code (Terraform, Bicep, ARM templates)
* Exposure to real-time/streaming data pipelines (Kafka, Event Hubs, Structured Streaming)
* Relevant Azure or Databricks certifications
Why This Role
* Full pipeline ownership: Own data infrastructure end to end, from ingestion through ML-ready delivery
* Modern data stack: Work with Azure and Databricks, leading platforms in enterprise data engineering
* Cross-functional impact: Directly enable machine learning and analytics outcomes, not just move data
* Flexibility: Remote-friendly engagement structure
How to Apply
Ready to bring your data engineering expertise to Azure and Databricks-powered ML infrastructure? Apply through Toptal here: https://www.toptal.com/talent/apply
To apply: https://weworkremotely.com/remote-jobs/toptal-senior-data-engineer-azure-databricks-ml-pipelines-remote
O texto permanece no idioma original da empresa, porque é nesse mesmo idioma que você vai se candidatar.
Perguntas frequentes sobre esta vaga
Posso me candidatar à vaga de Senior Data Engineer - Azure, Databricks & ML Pipelines | Remote de onde eu moro?
Sim. Para esta vaga, Toptal aceita candidatos de qualquer país do mundo, então você não precisa de autorização de trabalho de outro país. O anúncio passou por uma verificação automática: se a empresa exigisse autorização de trabalho, patrocínio de visto ou residência em um país específico, ele não estaria neste quadro.
Qual é a remuneração informada?
Para esta vaga, Toptal não divulgou remuneração. A maioria dos anúncios remotos não publica valor, isso é acertado na entrevista.
Como eu me candidato?
Você se candidata diretamente à empresa, pelo anúncio original publicado em We Work Remotely. Donator não recebe candidaturas, não cobra comissão e não guarda currículos.
Que tipo de vaga é esta?
Uma vaga totalmente remota na área de Dados e analytics. Anúncios híbridos e tudo o que exige presença no escritório não são publicados neste quadro.
Certificados gratuitos para esta vaga
Este anúncio pede Python, SQL, Machine Learning. Abaixo estão os certificados gratuitos que cobrem exatamente essas ferramentas.
Kaggle Learn: 17 micro-courses
certificateKaggle · ~4 h
Intro to ML, Pandas, SQL, Deep Learning, Computer Vision and more. Only a Google account is needed, and the certificate has a public link.
moderate weightCS50x: Introduction to Computer Science
certificateHarvard CS50 · ~100 h
Harvard's own branded certificate is free once you pass every problem set and the final project. The edX verified certificate is a separate paid product and is not needed.
strong brandDeveloper certificates (10+ tracks)
certificatefreeCodeCamp · ~300 h
A non-profit; a card is never requested. The certificate is issued after five projects are submitted and pass.
moderate weightDeep Reinforcement Learning course
certificateHugging Face · ~30 h
Entirely free with no deadline. 80% earns a Certificate of Completion, 100% a Certificate of Honors.
moderate weight
Vagas parecidas
Senior Data Scientist, Product
RevenueCat · ontem
NovaDa EuropaPythonSenior ML Engineer (Europe-based/Remote)
SWORD Health · há 5 dias
Da EuropaMachine LearningData Analytics Engineer
Ruby Labs · há 5 dias
Da EuropaSQLData Scientist (AI Data & LLM Specialist)
Eclipse Laboratories · há 6 dias
De qualquer lugarPythonMachine Learning
