Senior Data Scientist with Data Engineering Skills (kontraktor)

Itsg Global

Warszawa

On-site

PLN 165,312 - 330,624

Full time

14 days+
Application generator

A complete application in a minute — tailored resume and cover letter, ready to send.

Get past ATS filters

Benefits offered by this job

Budżet szkoleniowy
Lekcje języka angielskiego
Karta Multisport
Prywatna opieka medyczna
Wydarzenia integracyjne

Job summary

ITSG prowadzi rekrutację na kontrakt Data Science do projektu budowy systemu przewidywania popytu dla lidera polskiego rynku rozrywki. Zadania obejmują przygotowanie danych, projektowanie bazy, EDA i budowę modelu GLM, przy ścisłej współpracy z architektem danych i interesariuszami biznesowymi.

Wymagane jest minimum 5–7 lat doświadczenia, zaawansowana znajomość SQL i Pythona, oraz umiejętność pracy end-to-end z różnorodnymi źródłami danych. Elastyczność i samodzielność będą kluczowe.

Qualifications

  • Minimum 5–7 lat praktycznego doświadczenia w Data Science lub pokrewnym.
  • Bardzo dobra znajomość SQL: projektowanie schematów, zapytania analityczne, optymalizacja.
  • Bardzo dobra znajomość Pythona w kontekście analizy, przetwarzania i przygotowywania danych.
  • Umiejętność samodzielnego tworzenia skryptów do pobierania i przetwarzania danych.
  • Doświadczenie z bibliotekami Pandas, NumPy, BeautifulSoup, Scrapy lub podobnymi.
  • Doświadczenie z integracją danych z REST API, pliki flat, bazy legacy.
  • Doświadczenie z nieustrukturyzowanymi danymi.
  • Doświadczenie z eksploracyjną analizą danych.
  • Doświadczenie z modelami liniowymi / GLM i ich interpretacją.
  • Umiejętność walidacji modeli predykcyjnych oraz oceny jakości wyników.
  • Umiejętność samodzielnego przygotowania środowiska projektowego: Python, baza danych, zależności, repozytorium.

Responsibilities

  • Współpraca z architektem przy projektowaniu relacyjnej bazy danych w SQL; definiowanie schematu, typów danych, relacji i indeksów.
  • Pozyskiwanie danych z 3–4 źródeł zewnętrznych, w tym stron WWW, API, plików lub baz legacy.
  • Czyszczenie, transformacja i przygotowanie danych pod analizę oraz modelowanie.
  • Zasilanie bazy danych przygotowanymi danymi.
  • Eksploracyjna analiza danych, czyli EDA: identyfikacja zależności, anomalii, braków i problemów jakościowych.
  • Dokumentowanie wyników analiz oraz założeń dotyczących danych.
  • Budowa i walidacja modelu ML klasy GLM.
  • Iteracyjna praca z modelem oraz interpretacja wyników.
  • Tworzenie skryptów w Pythonie do automatyzacji etapów pozyskiwania i przetwarzania danych.
  • Utrzymywanie porządku w kodzie i dokumentacji: repozytorium, wersjonowanie, powtarzalność wyników.
  • Przygotowywanie dokumentacji technicznej i analitycznej.
  • Wykorzystywanie narzędzi AI wspierających development i analizę, m.in. Claude Code, Codex.

Skills

SQL
Python
Pandas
NumPy
BeautifulSoup
Scrapy
REST API
Data cleaning
EDA
GLM models
Model validation
Data prep
Documentation
English

Education

Bachelor's degree in Data Science / CS

Tools

Jupyter Notebook
H2O.ai
Claude Code
Codex
DVC
MLflow
Git

Job description

Kim jesteśmy?

Jesteśmy ITSG - wiodącym dostawcą spersonalizowanych rozwiązań dla wymagających klientów. Wierzymy, że każde wyzwanie ma swoje optymalne rozwiązanie i podchodzimy do niego z pełnym zaangażowaniem. Dostarczamy produkty cyfrowe, stosując nowoczesne rozwiązania i podejście skoncentrowane na wysokiej jakości.

Poszukujemy kontraktora Data Science do współpracy przy projekcie budowy systemu przewidywania popytu dla jednego z liderów polskiego rynku rozrywki - sieci kilkudziesięciu lokalizacji w całym kraju.

System będzie łączyć kilkuletnią historię sprzedaży z sygnałami zbieranymi z sieci, takimi jak trendy wyszukiwań, social media, box office czy metadane premier, a następnie przewidywać frekwencję na nadchodzące tytuły i wspierać decyzje dotyczące układania oferty w całej sieci.

Współpraca jest skierowana do specjalistów Data Science, którzy dobrze czują się nie tylko w analizie i modelowaniu, ale również w praktycznym przygotowaniu danych na wcześniejszym etapie: ich pozyskiwaniu, czyszczeniu, transformacji oraz przygotowaniu pod dalszą analizę.

To projekt dla osób, które nie oczekują gotowego, idealnie przygotowanego datasetu i potrafią samodzielnie przejść przez proces od surowych danych do modelu oraz wniosków biznesowych.

Projekt zakłada ścisłą współpracę z architektem danych oraz interesariuszami biznesowymi. Kluczowe będą samodzielność, skrupulatność i gotowość do działania na nieustrukturyzowanych oraz niewyczyszczonych danych.

Zakres zadań w projekcie:
  • Współpraca z architektem przy projektowaniu relacyjnej bazy danych w SQL; definiowanie schematu, typów danych, relacji i indeksów.
  • Pozyskiwanie danych z 3-4 źródeł zewnętrznych, w tym stron WWW, API, plików lub baz legacy.
  • Czyszczenie, transformacja i przygotowanie danych pod analizę oraz modelowanie.
  • Zasilanie bazy danych przygotowanymi danymi.
  • Eksploracyjna analiza danych, czyli EDA: identyfikacja zależności, anomalii, braków i problemów jakościowych.
  • Dokumentowanie wyników analiz oraz założeń dotyczących danych.
  • Budowa i walidacja modelu ML klasy GLM.
  • Iteracyjna praca z modelem oraz interpretacja wyników.
  • Tworzenie skryptów w Pythonie do automatyzacji etapów pozyskiwania i przetwarzania danych.
  • Utrzymywanie porządku w kodzie i dokumentacji: repozytorium, wersjonowanie, powtarzalność wyników.
  • Przygotowywanie dokumentacji technicznej i analitycznej.
  • Wykorzystywanie narzędzi AI wspierających development i analizę, m.in. Claude Code, Codex.
Oczekiwane kompetencje:
Doświadczenie i wiedza
  • Minimum 5-7 lat praktycznego doświadczenia w obszarze Data Science lub pokrewnym.
  • Bardzo dobra znajomość SQL: projektowanie schematów, zapytania analityczne, optymalizacja.
  • Bardzo dobra znajomość Pythona w kontekście analizy, przetwarzania i przygotowywania danych.
  • Umiejętność samodzielnego tworzenia skryptów do pobierania i przetwarzania danych.
  • Doświadczenie z bibliotekami lub narzędziami takimi jak Pandas, NumPy, BeautifulSoup, Scrapy lub podobnymi.
  • Doświadczenie z integracją danych z heterogenicznych źródeł, np. REST API, pliki flat, bazy legacy.
  • Doświadczenie z niekompletnymi, nieustrukturyzowanymi lub niewyczyszczonymi danymi.
  • Doświadczenie z eksploracyjną analizą danych.
  • Doświadczenie z modelami liniowymi / GLM i ich interpretacją.
  • Umiejętność walidacji modeli predykcyjnych oraz oceny jakości wyników.
  • Umiejętność samodzielnego przygotowania środowiska projektowego: Python, baza danych, zależności, repozytorium.
Kompetencje miękkie
  • Skrupulatność i dbałość o szczegóły; zarówno w danych, jak i w kodzie.
  • Samodzielność i gotowość do działania w projekcie, w którym dane nie są idealnie przygotowane.
  • Umiejętność porządkowania niekompletnych i nieustrukturyzowanych danych.
  • Bardzo dobra komunikacja.
  • Umiejętność ustalania wymagań i założeń z ekspertami domenowymi spoza obszaru analiz i technologii.
  • Dobra znajomość języka angielskiego.
Mile widziane
  • Znajomość H2O.ai będzie dużym atutem.
  • Znajomość Jupyter Notebook / JupyterLab.
  • Znajomość narzędzi do wersjonowania danych lub eksperymentów, np. DVC, MLflow.
  • Doświadczenie w projektach end-to-end: od pozyskania danych, przez analizę, po model predykcyjny.
  • Doświadczenie w pracy z narzędziami AI wspierającymi analizę lub development.
Warunki współpracy projektowej
  • Możliwość realizacji współpracy zdalnie, hybrydowo lub z biura w Warszawie.
  • Udział w projekcie tworzonym od podstaw: realny wpływ na podejście do danych, strukturę bazy, analizę oraz kierunek modelowania.
  • Możliwość działania end-to-end: od pozyskania i uporządkowania danych, przez EDA, aż po model predykcyjny i interpretację wyników dla biznesu.
  • Technologie wykorzystywane w projekcie: Python, SQL, Pandas, NumPy, GLM, H2O.ai, Jupyter Notebook / JupyterLab, Claude Code, Codex.
  • Elastyczne ramy realizacji zadań oraz ograniczona liczba spotkań.
  • Dodatkowo: możliwość korzystania z budżetu szkoleniowego, lekcji języka angielskiego, karty Multisport, prywatnej opieki medycznej oraz wydarzeń integracyjnych.
Get your free, confidential resume review.
or drag and drop your file here.
Similar jobs

Similar jobs worth comparing

Senior Data Scientist with Data Engineering Skills
Senior Data Scientist with Data Engineering Skills

ITSG Global • Warszawa

Hybrid
PLN 220,000 - 289,000
Budżet szkoleniowy
Lekcje języka angielskiego
Karta Multisport
+2
Data Scientist
Data Scientist

HeadHR • Wieluń

Hybrid
Opieka medyczna
Karta sportowa z dofinansowaniem
Dodatkowe 3 dni urlopu
Tech Lead .NET (kontraktor)
Tech Lead .NET (kontraktor)

Itsg Global • Warszawa

Hybrid
PLN 180,000 - 260,000
Budżet szkoleniowy
Karta Multisport
Prywatne ubezpieczenie medyczne
+1
Lead Data Scientist
Lead Data Scientist

DataServe • Poland

On-site
Elastyczne godziny pracy
Karta Multisport
Przyjazna atmosfera
Data Scientist
Data Scientist

DataServe • Poland

On-site
Elastyczne godziny pracy
Karta Multisport
Nieformalna atmosfera w biurze
Data Science Senior Specialist
Data Science Senior Specialist

Amplus Sp. z o.o. • Prandocin-Iły

Hybrid
PLN 120,000 - 240,000
Udział w projektach transformacji cyfł
Możliwość budowy AI/ML
Praca w interdyscyplinarnych zespołach
+2
Senior Data Science Analyst
Senior Data Science Analyst

Knowit Poland • Łódź

On-site
PLN 240,000 - 360,000
Expert Data Analyst
Expert Data Analyst

Talanto • Poland

Hybrid
PLN 210,000 - 330,000
Hybrid work in Warsaw
Senior Data Analyst
Senior Data Analyst

Codest Ltd. Company No. 12590542, VAT number: GB363431020 • Warszawa

On-site
PLN 120,000 - 190,000
Senior Python Engineer (kontraktor)
Senior Python Engineer (kontraktor)

Itsg Global • Warszawa

Hybrid
PLN 230,000 - 320,000
Opieka medyczna prywatna
Karta Multisport
Lekcje języka angielskiego
+1