

Search by job, company or skills

Job Overview
Design, build, and maintain robust, scalable, and high-performance data pipelines (batch and streaming).
Develop and optimize ETL/ELT workflows using modern orchestration tools (e.g., Airflow, dbt, ADF, Databricks, Prefect).
Collaborate with Data Scientists, Analysts, and Business stakeholders to ensure data models support analytical and AI/ML needs.
Integrate data from multiple sources (SQL/NoSQL databases, APIs, flat files, etc.) into centralized warehouses or lakehouses.
Implement and enforce data quality, integrity, and governance standards across the pipeline.
Work with cloud platforms (Azure, AWS, or GCP) for data storage, compute, and orchestration.
Contribute to data schema design, query optimization, and performance tuning.
Maintain detailed technical documentation for pipelines, jobs, and data models.
Actively participate in code reviews, design discussions, and production support.
Job Qualification
Programming: Python (Pandas, PySpark, SQLAlchemy), SQL (advanced query writing
and optimization)
ETL / Orchestration Tools: Apache Airflow, Azure Data Factory, or Prefect
Data Processing Frameworks: PySpark / Spark
Job ID: 151579429
Skills:
Java, Hadoop Ecosystem, Cassandra, Pyspark, Scala, Sql, Cloud Storage, Git, Spark, MongoDB, Apache Beam, DataFlow, Python, NoSQL databases, Cloud Composer
Skills:
snowflake , Amazon Kinesis, Pyspark, Sql, Apache Airflow, Jenkins, Git, Apache Kafka, Python, CI CD, Delta Lake on Databricks, Data Quality Validation, Databricks Workflows
Skills:
snowflake , Azure Data Factory, Power Bi, Sql, Python
Skills:
Pyspark, Sql, Azure Synapse, Azure ML, Azure Data Factory, Databricks, Azure DevOps, FiveTran, GCP Cloud Composer, Vertex AI, GCP BigQuery, GCP DLP, GCP Cloud Run
Skills:
snowflake , Java, BigQuery, Scala, Kafka, Redshift, Sql, ELT, Gcp, Spark, Databricks, Azure, Python, AWS, Etl, Airflow