Deine Aufgabe
Dies ist eine
Senior Cloudera Developer (Data Engineer) Rolle, die 6 bis 10 Jahre Erfahrung erfordert. Diese Position ist in
Pune angesiedelt.
Aufgaben
- Entwerfen, entwickeln und implementieren von Datenlösungen mit Cloudera-Technologien wie Hadoop, Spark und Hive
- Zusammenarbeit mit Data Engineers zur Optimierung von Datenpipelines und Datenverarbeitungsworkflows
- Enge Zusammenarbeit mit Datenanalysten und Data Scientists, um Datenqualität und -integrität sicherzustellen
- Fehlersuche und Lösung von Problemen mit Datenverarbeitungs- und Datenspeichersystemen
- Auf dem neuesten Stand bleiben über aktuelle Trends und Best Practices in der Cloudera-Entwicklung
- Teilnahme an Code-Reviews und Feedback an Teammitglieder geben
- Durchführung von Extract, Transform und Load (ETL) Prozessen mit Spark
- Integration von Spark Streaming mit anderen Technologien wie Kafka
- Bereitstellung und Verwaltung von Spark-Anwendungen auf einem Hadoop-Cluster oder auf GCP Dataproc
Dein Profil
Wir suchen einen
Senior Cloudera Developer (Data Engineer) mit umfangreicher Erfahrung in Spark, Hadoop-Ökosystem und GCP-Diensten zur Gestaltung und Implementierung von Datenlösungen.
Muss-Kriterien
- 6 bis 10 Jahre Erfahrung
- Kompetenz in der Arbeit mit Spark
- Verständnis der Spark-Architektur und Fehlertoleranz-Mechanismen
- Kompetenz in der Verwendung von Spark DataFrames und Spark SQL für die Abfrage strukturierter Daten
- Fähigkeiten bei der Durchführung von Extract Transform and Load (ETL)-Prozessen mit Spark
- Fundierte Kenntnisse in Python
- Bachelor-Abschluss in Informatik, Informationstechnologie oder einem verwandten Bereich
- Nachgewiesene Erfahrung als Cloudera Developer oder in einer ähnlichen Rolle
- Solides Verständnis von Cloudera-Technologien wie Hadoop, Spark und Hive
- Erfahrung mit Datenmodellierung, Data Warehousing und Datenintegration
- Ausgeprägte Programmierkenntnisse in Java, Scala oder Python
- Ausgezeichnete Problemlösungsfähigkeiten
- Hervorragende Kommunikationsfähigkeiten
- Fähigkeit, sowohl eigenständig als auch im Team zu arbeiten
Wünschenswert
- Erfahrung in der Optimierung von Spark-Ausführungsplänen
- Erfahrung mit der Integration von Spark Streaming mit anderen Technologien wie Kafka
- Vertrautheit mit dem Hadoop-Ökosystem einschließlich Tools wie HDFS, Hive, Cloudera-Stack
- Erfahrung mit der Bereitstellung und Verwaltung von Spark-Anwendungen auf einem Hadoop-Cluster oder auf GCP Dataproc
- Erfahrung mit Java-Programmierung
- Kenntnisse in DevOps-Tools und -Praktiken (CI/CD, Docker)
- Praktische Erfahrung mit GCP-Diensten (Dataproc, Cloud Function, Cloud Run, Pub Sub, BigQuery)
Über uns
T-Systems Information and Communication Technology India Private Limited (T-Systems ICT India Pvt. Ltd.) ist stolzer Empfänger der prestigeträchtigen Great Place To Work® Certification™.
Als hundertprozentige Tochtergesellschaft der T-Systems International GmbH ist T-Systems India an den Standorten Pune, Bangalore und Nagpur tätig und verfügt über ein engagiertes Team von
über 3500 Mitarbeitern, die Dienstleistungen für Konzernkunden erbringen.
T-Systems bietet integrierte End-to-End-IT-Lösungen und treibt die digitale Transformation von Unternehmen in allen Branchen voran, darunter:
- Automobilindustrie
- Fertigung
- Logistik und Transport
- Gesundheitswesen
- Öffentlicher Sektor
T-Systems entwickelt vertikale, unternehmensspezifische Softwarelösungen für diese Sektoren.
T-Systems International GmbH ist ein Unternehmen für Informationstechnologie und digitale Transformation mit Präsenz in über 20 Ländern und einem Umsatz von mehr als 4 Milliarden Euro. T-Systems ist ein weltweit führender Anbieter von digitalen Dienstleistungen und verfügt über mehr als 20 Jahre Erfahrung in der Transformation und dem Management von IT-Systemen.
Als Tochtergesellschaft der Deutschen Telekom und Marktführer in Deutschland bietet T-Systems International sichere, integrierte Informationstechnologie und digitale Lösungen aus einer Hand.