Search by job, company or skills

Data Engineer

8-10 Years
  • Posted 2 days ago
  • Be among the first 10 applicants

Job Description

Roles and Responsibilities

  • Architect and maintain enterprise-grade ELT and ETL data pipelines using Python, PySpark, Kafka, and Databricks to manage large-scale risk data.
  • Build and deploy GenAI agents utilizing Google ADK, Google Flash 2.5+ LLMs, and Model Context Protocol (MCP) integrated with Human-in-the-Loop workflows.
  • Design, automate, and deploy microservice integrations for data-intensive applications on OpenShift and Kubernetes using robust CI/CD pipelines.
  • Implement data federation layers supporting Lambda and Data Mesh architectures via Starburst to enable AI/ML and NLP use cases.
  • Leverage agentic AI platforms and development assistants such as Devin.AI and GitHub Copilot with prompt engineering to increase engineering velocity.
  • Enforce data governance, risk management policies, and regulatory compliance standards across all data platforms.

Preferred Candidate Profile

  • Work Experience: 8+ years in large-scale application development with 5+ years in a Python and PySpark Data Engineering lead role.
  • Educational Background: Bachelor's degree in Computer Science, Engineering, or a related field (Master's degree preferred).
  • Core Technical Skills: Python, PySpark, Databricks, Google ADK, LLMs, FastAPI, Spring Boot, Microservices, Kafka, SQL, Data Mesh, Starburst.
  • Infrastructure and Cloud: Kubernetes, OpenShift, Docker, Cloud-Native Infrastructure, CI/CD pipelines.
  • Industry Context: Data engineering experience in Banking Risk, Retail Products, Cards, Mortgage, Deposits, or Wealth Management.
  • Assumed Requirements / Certifications: Databricks Certified Data Engineer, AWS Certified Data Analytics, or Azure Data Engineer Associate.

More Info

Job Type:
Industry:
Employment Type:

About Company

Job ID: 153368225

Similar Jobs

Pune, India

Skills:

Document Databases Working knowledge of MongoDBETL Tools Proficiency in Ab Initio GDE EME Co Operating SystemUnix Linux ScriptingSQL PL SQL QueryingTesting QA Exposure to SIT E2E and OAT testing cyclesMessaging Systems Experience with IBM MQ Apache KafkaAgile Delivery Experience with JIRAScheduling Tools Familiarity with Tivoli Workload Scheduler TWSSecurity Compliance Awareness of access control vulnerability assessments

Pune, India

Skills:

.NETdata warehouses Spark SQLPower BiAzure Log AnalyticsPowershell ScriptingHiveAzure Data FactoryData lakesMicrosoft Azure Data platformAzure SQL Data WarehouseAzure Storage ServicesAzure Application InsightsData BricksStream Analyticsdata martsEvent HubsAzure SQL DBAzure Analysis Services

Pune, India

Skills:

JavaUnixApache FlinkData ModelingSchema DesignPysparkData CleansingApache SparkData Warehouse ConceptsShell ScriptingSqlELTApache AirflowLinuxApache KafkaRestful ApisPythonEtlData TransformationData Quality Validation

Pune, India

Skills:

snowflake KafkaELTDevopsSparkIncident ManagementDatabricksRestful ApisAzureEtlAWSAirflowMonitoring

Pune, India

Skills:

Data GovernanceData ModelingSqlPythondata orchestration workflowsdata quality frameworksdistributed data processing frameworksETL pipelines

Beware of Scammers

We don’t charge money for job offers