Data Engineer

Bratislava, Brno, Praha

Pro muže i ženy Plný úvazek

S čím se budete potkávat

Hadoop
Java
Kafka
Kubernetes
Python
Scala
Spark

Data jsou srdcem Vyhledávání Seznamu. Denně jich zpracováváme obrovské množství a stojí za vším od analytiky přes trénování modelů až po rozhodování o dalším rozvoji produktu. 

Hledáme vývojáře, kterého baví stavět datové pipeline (transformace, čištění, propojování, agregace, filtrace, převádění do jiného formátu, atd.) a bude řešit zpracování velkých objemů dat a navrhovat technická řešení, která mají okamžitý dopad na jeden z největších internetových produktů v Česku. To vše s využitím AI nástrojů. 

Budete součástí BI týmu v divizi Seznam AI, kde se úzce spolupracuje s kolegy ze sběru dat, výzkumu, analytiky i produktových nástrojů. 

Co budete dělat 

  • příprava a zpracování dat pro jejich další využití 
  • návrh technického řešení (často ve spolupráci s týmem výzkumu) 
  • provozování, údržba a rozvoj stávajících komponent ve správě týmu 
  • zabezpečování a sledování kvality dat 
  • sledování a adaptace na technologické novinky v oblasti zpracování velkých dat 

Co budete potřebovat 

  • znalost pokročilého zpracování dat a zkušenosti se stavbou datových pipeline (transformace, čištění, propojování, agregace, filtrace) 
  • alespoň 2 roky zkušeností s programováním 
  • znalost Python, Scala nebo Java 
  • Ideálni  je orientace v technologiích pro zpracování velkých dat – Kubernetes, Hadoop, Apache Kafka, Apache Spark 
  • zájem o open source technologie a chuť pracovat s podporou nejmodernějších AI modelů 

Těšit se můžete na 

  • práci na jedinečném produktu – Vyhledávání Seznam.cz, které v ČR stále odolává globálnímu Googlu 
  • podíl na vývoji nově vznikajícího konverzačního nástroje Seznam Asistent 
  • obor, který se neustále vyvíjí, takže se práce nikdy nestane rutinou 
  • neformální atmosféru a partu přátelských kolegů 
  • prostor pro seberealizaci a osobní rozvoj, možnost učit se nové technologie a postupy 
  • flexibilní pracovní dobu a home office 

Jak probíhá výběrko 

  • po zaslání přihlášky se vám do 3 dní ozveme, abychom zjistili více o vašich zkušenostech a sladili očekávání 
  • dalším krokem je zadání, které prověří vaše zkušenosti se zpracováním dat 
  • po úspěšném absolvování zadání následuje osobní/zoom pohovor, kde si zadání rozebereme, doptáme se na další oblasti a bude i prostor na vaše otázky 

Co je v Seznamu taky bezva

Budget pro volný čas
Vyměnit body za kulturu, zdraví, sport, dovolenou nebo extra volno? Beze všeho.
Dny volna navíc
K dovolené ještě dalších 5 dnů? No fakt. Ať už chcete třeba jen lenošit nebo vás hezké počasí naopak žene ven, užijte si volno podle vašich představ.
Interní vzdělávání
U nás se nudit nebudete. Osobnímu i profesnímu rozvoji fandíme a nabízíme nekonečně příležitostí k seberozvoji a vzdělávání, včetně pomoci od profesionálních trenérů.
Pružná pracovní doba
Někdo je ranní ptáče a nejvíc práce udělá se svítáním, někdo zas sova a nejvíc klidu na práci má večer. Důležité jsou pro nás kvalitní výsledky, ne váš rozvrh hodin.
Technika na přání
Apple, Linux nebo Windows? Všechno máme a k dispozici dáme. A pokud už jste zvyklí na své vymazlené miláčky, pracujte klidně na vlastním zařízení a my vám budeme finančně přispívat.

Kde budete pracovat

Mapa Česko a Slovensko
Bratislava
Seznam.cz Slovensko, s.r.o.
Bottova 7939/2A
811 09 Bratislava – Staré Mesto
Slovensko
Bus
50 68 88 90
Brno
Seznam.cz, a.s.
The Campus Science Park – Budova C
Palachovo náměstí 797/4
625 00 Brno – Starý Lískovec
Nejbližší zastávka je Nemocnice Bohunice. Pokud jste přijeli vlakem, na nádraží skočte do šaliny č. 8 a za 20 minut jste u nás. Parkovat lze v podzemních garážích nebo v okolních oblastech Campus Square.
Šalina
8
Bus
40 50 51 69 E56
Trolejbus
25 37
Praha
Seznam.cz, a.s.
Radlická 3294/10
150 00 Praha 5 – Smíchov
Naše centrála je velmi dobře dostupná, můžete dorazit metrem na lince B, jednou z nesčetných tramvají nebo autobusem. Autobusové nádraží Na Knížecí je hned za rohem.
Metro
B – Anděl
Tramvaj
4 5 7 9 10 12 15 16 20
Bus
120 123 137 167 191

První dny v Seznamu

Koukněte, jak vypadá první den, ať se vaše cesta na vysněnou pozici obejde bez zbytečných škobrtnutí.

1 Vítejte na palubě aneb Pre-onboarding

Skvěle, plácli jsme si na spolupráci. Nástupní dokumenty podepíšete elektronicky klidně ještě před nástupem. Žádné papírování, šetříme přírodu. A když budete chtít, můžeme se rovnou domluvit na kafe s někým z týmu, ať se naladíte na naši atmosféru.

2 Hurá, váš první den v Seznamu

Každý začátek měsíce vítáme všechny nováčky u nás na centrále v Praze. Vyřešíme potřebnou administrativu, předáme vám techniku, seznámíme vás s kolegy a nakonec vás provedeme po našem labyrintu.

3 Adaptace aneb jééé, funguje to!

Na začátku to vypadá možná trochu chaoticky, ale nebojte, máme promakaný systém školení pro každou pozici, takže co neumíte, rádi naučíme.

4 Umíte vše levou zadní? Pak je tu interní vzdělávání

Po rozpačitém začátku jste už profíci v oboru, gratulujeme. A protože umět všechno je nuda, náš tým trenérů vám rád poradí s dalším rozvojem. A nabídka je nekonečně bohatá, vybrat si můžete z našeho e-learningu nebo školení přímo na míru.

Časté dotazy

Jak pracujeme s Big Data?

Využíváme Spark, Hadoop, Flink a Kafka pro zpracování a analýzu velkých objemů dat. Implementujeme Elasticsearch pro full-textové vyhledávání v aplikacích.

Jak využíváme cloud a jak probíhá nasazování?

Veškeré aplikace a služby provozujeme ve firemních Kubernetes clusterech spravovaných našimi týmy infrastruktury. Databáze a další klíčové komponenty běží interně — některé nasazují přímo SRE/admini, zatímco u jiných týmů probíhá nasazování samostatně prostřednictvím ArgoCD. Vývoj a nasazování je úzce propojeno s CI/CD v GitLabu, kde probíhají automatické buildy a pipelines, které následně spouštějí nasazení do Kubernetes. K tomu využíváme technologie jako Docker, OpenStack a pro prototypování také JupyterLab. U ML projektů využíváme MLOps pipelines, které zahrnují automatické validace, A/B testování, nasazování a monitoring. Pro sledování metrik a stavu systémů používáme Prometheus, což zajišťuje spolehlivý a kontrolovaný provoz všech služeb.

Jaké AI nástroje využíváme při vývoji?

Při vývoji využíváme AI asistenty a agenty integrované do vývojových prostředí, přičemž konkrétní nástroje se mohou lišit podle týmu a preferencí vývojáře. Mezi nejčastěji používané patří JetBrains Junie, GitHub Copilot, Cursor nebo Claude Code, pro které máme firemní licence. Kromě toho používáme v rámci specifických projektů AI také pro text-to-speech, interní LLM (Sellma) nebo neuronové sítě pro detekci obrazu, například pro rozpoznávání nahoty, tváří, textu či objektů.

Jaké verze Pythonu používáme?

Primárně pracujeme s moderními verzemi Pythonu řady 3, nejčastěji v rozmezí od Pythonu 3.9 po Python 3.13. Konkrétní verze se může lišit podle projektu, divize nebo týmu – dáváme týmům určitou volnost ve volbě nástrojů, zároveň však dbáme na to, abychom drželi krok s aktuálním vývojem. Výjimečně udržujeme i starší verze Pythonu, a to zejména z důvodu zpětné kompatibility se stávajícími systémy.

Jaké verzovací nástroje využíváme?

Veškeré projekty spravujeme pomocí Gitu, přičemž GitLab slouží jako centrální platforma pro hostování repozitářů a pro kontinuální integraci (CI).

Zajímá vás tato pozice?

Zajímá vás tato pozice?