Podvodné praktiky vo vede sú rozšírený, no často skrytý problém. V dnešnej digitálnej dobe, plnej dezinformácií, je čoraz dôležitejšie zabezpečiť autenticitu vedeckých tvrdení pre udržanie dôvery vo vedu. Jedným z prístupov na odhaľovanie podvodných publikácií je detekcia manipulácie s dátami prostredníctvom štatistických metód. Na efektívne uplatnenie týchto metód je však najprv potrebné získať relevantné údaje z PDF súborov. Keďže PDF formát je navrhnutý predovšetkým na zachovanie vizuálneho formátovania, predstavuje výzvu pre automatizovanú extrakciu dát. Táto diplomová práca poskytuje prehľad rôznych metód na detekciu tabuliek a extrakciu dát z PDF dokumentov. Zároveň opisuje vývoj a návrh webovej aplikácie, ktorá integruje vybrané metódy s cieľom ponúknuť automatickú detekciu tabuliek a extrakciu dát. Aplikácia poskytuje užívateľské rozhranie, ktoré umožňuje používateľom interagovať s procesom detekcie a extrakcie.