

Search by job, company or skills

Experience
●3 years of relevant experience
Key Skills
●Strong hands-on experience in ETL processes
●Proficiency in PySpark
●Good understanding of data pipelines and data transformation
●Experience working with large datasets
Good to Have
●Exposure to web scraping techniques
Role Summary
We are looking for a Data Engineer to design, build, and maintain scalable data pipelines. The
role involves working with ETL workflows, processing large volumes of data using PySpark, and
ensuring data quality and reliability for downstream analytics and business use.
Job ID: 152527733
Skills:
Big Data Technologies, Data Warehousing, Dataproc, Python Programming, Google Cloud Platform GCP, Cloud Composer, SQL PostgreSQL, Cloud Pub Sub, ETL Development Data Pipelines, Large Dataset Processing
Skills:
Pyspark, Azure Data Factory, Apache Kafka, Python, Sql, Azure DevOps, Azure Databricks Unity Catalog Delta live tables, Data Modelling Architecture, ETL pipeline design, Azure cloud data services technologies, Logging and Monitoring using Azure Databricks services
Skills:
Adf, SQL Server, Data Warehousing Concepts, Sql, Git, Terraform, Shell scripting, Python, Data observability tooling, Containerisation technologies, GNU Linux systems, Data modelling techniques, AI-assisted development tooling, Azure Platform, ETL ELT pipelines, CI CD practices, Data quality frameworks
Skills:
cloud security, Azure Databricks, Sql, Python, Databricks Metric Views, business ontology semantic modelling concepts, Git version control, CI CD pipelines, ELT ETL tooling, RBAC in Azure and Databricks, data modelling techniques, data quality lineage and reconciliation
Skills:
Azure Data Factory, Pyspark, Sql, Delta Live Tables, Data Bricks