Data Engineer (Scala/Java/Python)
- Salary
- PLN 120–PLN 150/hr
- Hiring from
- Poland
- Work type
- Hybrid
- Posted
Show job descriptionHide job description
Data Engineer (Scala/Java/Python)
Clurgo to firma stworzona przez developerów dla developerów. Nasze zespoły łączą pełne spektrum kompetencji - od rozwoju oprogramowania i infrastruktury, przez analizę oraz testy, aż po strategiczne zarządzanie produktem i procesami. Realizujemy różnorodne projekty IT dla klientów z wielu branż, dbając o dobre praktyki programistyczne i zachowanie work-life balance. Tworzymy rozwiązania, które mają znaczenie - dla firm w Polsce i na całym świecie.
✅ Dołącz do projektu realizowanego dla dużej organizacji z sektora bankowego, gdzie będziesz rozwijać skalowalne rozwiązania do przetwarzania i integracji danych. Rola łączy Data Engineering i Software Engineering – obejmuje budowę pipeline’ów, pracę ze Scala, Java i Pythonem, orkiestrację procesów w Apache Airflow oraz integrację platform i API.
✅Technologie i narzędzia: Scala, Java, Python, SQL, Apache Airflow, REST API, Git, CI/CD, Google Cloud Platform (GCP), BigQuery, Cloud Storage, Pub/Sub, Dataflow, Dataproc, Apache Spark
Szukamy Ciebie, jeśli:
- masz minimum 3 lata doświadczenia w Data Engineering lub zbliżonej roli i bardzo dobrze programujesz w Scala, Java oraz Pythonie,
- dobrze znasz SQL oraz potrafisz budować i utrzymywać skalowalne pipeliny oraz rozwiązania do przetwarzania danych,
- pracowałeś/aś z Apache Airflow przy tworzeniu, orkiestracji i utrzymaniu workflowów danych,
- masz doświadczenie z REST API, Git i CI/CD oraz stosujesz dobre praktyki Software Engineering w projektach data,
- potrafisz samodzielnie diagnozować problemy, optymalizować rozwiązania i bierzesz odpowiedzialność za dostarczane komponenty
- dobrze odnajdujesz się we współpracy z Data Architectami, Software Engineerami, zespołami platformowymi, analitykami i biznesem
Mile widziane:
- doświadczenie z Google Cloud Platform (GCP) i usługami takimi jak BigQuery, Cloud Storage, Pub/Sub, Dataflow czy Dataproc,
- znajomość Apache Spark i rozwiązań do rozproszonego przetwarzania danych,
- doświadczenie z architekturą Data Fabric, integracją danych, governance, data discovery i kontrolą dostępu
Zadania:
- projektowanie, rozwój i utrzymanie niezawodnych pipeline’ów danych oraz frameworków Data Engineering,
- tworzenie skalowalnych rozwiązań do przetwarzania danych z wykorzystaniem Scala, Java i Python,
- rozwój i utrzymanie workflowów w Apache Airflow,
- integracja platform danych, aplikacji i innych komponentów poprzez REST API,
- udział w rozwoju architektury Data Fabric, w tym integracji danych, governance, discovery oraz access management,
- monitorowanie, diagnozowanie i optymalizacja wydajności, odporności i jakości rozwiązań danych,
- stosowanie dobrych praktyk inżynierskich, m.in. version control, testing, code review, dokumentacji i CI/CD,
- współpraca z architektami danych, inżynierami oprogramowania, zespołami platformowymi, analitykami oraz interesariuszami biznesowymi
Czego możesz się spodziewać:
- współpracy w oparciu o kontrakt B2B
- pracy hybrydowej 6x w miesiąciu z biura w Krakowie
- profesjonalnego procesu rekrutacyjnego – zawsze otrzymasz od nas feedback niezależnie od decyzji
Poznaj nas lepiej👉 https://www.facebook.com/clurgo/