Search Jobs

Search by job, company or skills

Pyspark Developer
  • Posted 2 hours ago
  • Be among the first 10 applicants

Job Description

Overall Experience: 5 to 10 Years

Location: Chennai/Bengaluru/Hyderabad/Pune/Kolkata

Notice Period: 0-30 Days / Immediate Joiners Only

Competencies Required

Essentials

  • PySpark and Spark SQL
  • Working with Dataframes using different APIs
  • Spark Functions
  • Advanced Data transformations
  • Good knowledge in SQL
  • Applying UDFS
  • Error handling, logging and monitoring
  • Unix, Scheduling Tool
  • Performance Tuning & Generic process development
  • Banking Domain Knowledge

Desirable

  • ETL Estimation
  • Teradata BTEQ

Responsibility of / Expectations from the Role

1. ETL Technical Designing, Guiding Team for solving Technical Problems, Providing Technical Solution to Client

2. Understanding Business Requirement and converting to Technical specification, Execution Planning

3. Effort Estimation, Task assignment to the team and tracking of activities, Performance Tuning

4. Hands on development for complex modules, ensuring coding standards, quality of delivery

More Info

Job Type:
Industry:
Function:
Employment Type:

Key Skills

Logging and monitoring

Dataframes

ETL Estimation

Unix Scheduling Tool

Generic process development

Advanced Data transformations

Error handling

UDFS

Spark Functions

Teradata BTEQ

Similar Jobs

5-8 yrs
Bengaluru, India
Skills:
HadoopPysparkScalaMapreduceUnix Shell ScriptingHiveSparkTensorflowPythonPytorchscikit-learnMachine Learning TechniquesSparkML
6-8 yrs
Bengaluru, India
Skills:
Spark SQLSpark CoreHiveSpark StreamingHadoopPysparkData WarehousingUnix Shell ScriptingEtlHDFSBatch Processing
6-8 yrs
Bengaluru, India
Skills:
HiveHadoopPysparkData WarehousingUnix Shell ScriptingSqlEtlSpark SQLSpark CoreSpark StreamingHDFS
10-12 yrs
Bengaluru, India
Skills:
data wrangling PysparkUnit TestingApisDebuggingOopConcurrencyGitNumpyCore PythonData PipelinePandasException HandlingData LoadingRestful ServicesVector OperationsDecoratorsDataframesParallel ProcessingGen AILambda FunctionsDB ConnectivityError Handling