

Search by job, company or skills

Primary skills: Python, SQL, data lakes, azure
Experience: 4+ years
Immediate Joiner
Key Responsibilities
Pipeline Development & Automation
· Design, build, and maintain CI/CD pipelines to automate deployment of DQ rules and data services across environments.
· Optimize data pipelines and jobs for efficiency, scalability, and enterprise-grade reliability within Azure and Databricks.
· Implement best practices in version control, testing, and automated deployments.
Data Quality & Rule Development
· Develop, optimize, and maintain DQ rules in PySpark/Python for self-serve capabilities.
· Design and implement profiling frameworks for rule generation and automated remediation.
· Ensure DQ frameworks align with enterprise standards, governance, and audit requirements.
UI & Self-Serve Integration
· Collaborate with front-end teams (Node.js/Angular) to enable rule configuration, validation, and monitoring via a low-code UI.
· Develop APIs and services to expose DQ results and outputs for dashboards and self-service tools.
Collaboration & Governance
· Partner with Data Stewards, GPOs, and business owners to translate requirements into technical solutions.
· Contribute to BRDs, SRDs, and design reviews for DQ rules and pipelines.
· Provide inputs on governance, compliance, and change management processes.
· Support periodic reviews and continuous improvements of pipelines, rules, and dashboards.
Required Skills & Qualifications
Education & Experience
Job ID: 144845931
Skills:
Metadata Management, Databricks, Python, Data lineage techniques, Master data management, Data modeling methodologies, Big Data storage architecture
Skills:
Git, Spark, Python Programming, Data Modeling, Databricks, Advanced Sql, Building scalable ETL pipelines, Data warehousing and BI tools integration
Skills:
Oracle Cloud, RDBMS, Power Bi, Tableau, Workday, Sql, Salesforce
Skills:
Hadoop, Scala, Jira, Impala, Jenkins, Git, Hive, Confluence, Spark, Agile, Nexus, Advanced Sql, CI CD Tools, Relational Databases, OS UNIX
Skills:
Data governance and quality assurance practices, Databricks Unified Data Analytics Platform, Building and managing scalable data pipelines and workflows, Data integration and ETL processes, Cloud-based data storage and processing solutions