Zobrazit minimální záznam

Medieval manusripts' analysis
dc.contributor.advisorŠikudová, Elena
dc.creatorPiptová, Marcela
dc.date.accessioned2021-07-23T10:05:57Z
dc.date.available2021-07-23T10:05:57Z
dc.date.issued2021
dc.identifier.urihttp://hdl.handle.net/20.500.11956/127964
dc.description.abstractTato práce se věnuje analýze historických manuskriptů s využitím statistických metod. Konkrétně se jedná o binarizaci dokumentu, tj. oddělení popředí od pozadí, dále detekci řádek textu a nakonec rozdělování těchto řádek na jednotlivá slova. Oproti tištěným dokumentům je tento proces ovšem značně komplikován obecně horší kvalitou rukopisů, nepravidelnou strukturou dokumentu, ozdobnými prvky přímo v textu apod. V práci uvádíme možné přístupy k řešení těchto problémů a detailně popisujeme algoritmus, který byl navržen a zvolen k implementaci. Důraz je kladen zejména na to, aby byly co nejlépe nalezeny a odstraněny netextové oblasti (iluminace apod.) v dokumentu. Součástí práce jsou i experimenty a vyhodnocení úspěšnosti zvolené metody. 1cs_CZ
dc.description.abstractThis thesis deals with an analysis of medieval manuscripts using statistical methods. Firstly, the document is binarized, i.e. the foreground regions are classified. Then the detection of text lines is performed. Finally, detected text lines are split into separate words. This process is more complicated for historical manuscripts compared to printed documents due to their age, irregular page layout and non-textual parts (images) within the text. In this text, various approaches to these problems are discussed. Particular attention is paid to the algorithm that was designed and implemented to perform the detection and deletion of non-textual parts of the document. Experimental results are included and evaluated. 1en_US
dc.languageČeštinacs_CZ
dc.language.isocs_CZ
dc.publisherUniverzita Karlova, Matematicko-fyzikální fakultacs_CZ
dc.subjectbinarizace|segmentace|detekce řádkůcs_CZ
dc.subjectbinarization|segmentation|line detectionen_US
dc.titleAnalýza starých manuskriptůcs_CZ
dc.typebakalářská prácecs_CZ
dcterms.created2021
dcterms.dateAccepted2021-07-02
dc.description.departmentDepartment of Software and Computer Science Educationen_US
dc.description.departmentKatedra softwaru a výuky informatikycs_CZ
dc.description.facultyMatematicko-fyzikální fakultacs_CZ
dc.description.facultyFaculty of Mathematics and Physicsen_US
dc.identifier.repId235695
dc.title.translatedMedieval manusripts' analysisen_US
dc.contributor.refereeBída, Michal
thesis.degree.nameBc.
thesis.degree.levelbakalářskécs_CZ
thesis.degree.disciplineGeneral Computer Scienceen_US
thesis.degree.disciplineObecná informatikacs_CZ
thesis.degree.programInformatikacs_CZ
thesis.degree.programComputer Scienceen_US
uk.thesis.typebakalářská prácecs_CZ
uk.taxonomy.organization-csMatematicko-fyzikální fakulta::Katedra softwaru a výuky informatikycs_CZ
uk.taxonomy.organization-enFaculty of Mathematics and Physics::Department of Software and Computer Science Educationen_US
uk.faculty-name.csMatematicko-fyzikální fakultacs_CZ
uk.faculty-name.enFaculty of Mathematics and Physicsen_US
uk.faculty-abbr.csMFFcs_CZ
uk.degree-discipline.csObecná informatikacs_CZ
uk.degree-discipline.enGeneral Computer Scienceen_US
uk.degree-program.csInformatikacs_CZ
uk.degree-program.enComputer Scienceen_US
thesis.grade.csVýborněcs_CZ
thesis.grade.enExcellenten_US
uk.abstract.csTato práce se věnuje analýze historických manuskriptů s využitím statistických metod. Konkrétně se jedná o binarizaci dokumentu, tj. oddělení popředí od pozadí, dále detekci řádek textu a nakonec rozdělování těchto řádek na jednotlivá slova. Oproti tištěným dokumentům je tento proces ovšem značně komplikován obecně horší kvalitou rukopisů, nepravidelnou strukturou dokumentu, ozdobnými prvky přímo v textu apod. V práci uvádíme možné přístupy k řešení těchto problémů a detailně popisujeme algoritmus, který byl navržen a zvolen k implementaci. Důraz je kladen zejména na to, aby byly co nejlépe nalezeny a odstraněny netextové oblasti (iluminace apod.) v dokumentu. Součástí práce jsou i experimenty a vyhodnocení úspěšnosti zvolené metody. 1cs_CZ
uk.abstract.enThis thesis deals with an analysis of medieval manuscripts using statistical methods. Firstly, the document is binarized, i.e. the foreground regions are classified. Then the detection of text lines is performed. Finally, detected text lines are split into separate words. This process is more complicated for historical manuscripts compared to printed documents due to their age, irregular page layout and non-textual parts (images) within the text. In this text, various approaches to these problems are discussed. Particular attention is paid to the algorithm that was designed and implemented to perform the detection and deletion of non-textual parts of the document. Experimental results are included and evaluated. 1en_US
uk.file-availabilityV
uk.grantorUniverzita Karlova, Matematicko-fyzikální fakulta, Katedra softwaru a výuky informatikycs_CZ
thesis.grade.code1
uk.publication-placePrahacs_CZ
uk.thesis.defenceStatusO


Soubory tohoto záznamu

Thumbnail
Thumbnail
Thumbnail
Thumbnail
Thumbnail
Thumbnail
Thumbnail

Tento záznam se objevuje v následujících sbírkách

Zobrazit minimální záznam


© 2017 Univerzita Karlova, Ústřední knihovna, Ovocný trh 560/5, 116 36 Praha 1; email: admin-repozitar [at] cuni.cz

Za dodržení všech ustanovení autorského zákona jsou zodpovědné jednotlivé složky Univerzity Karlovy. / Each constituent part of Charles University is responsible for adherence to all provisions of the copyright law.

Upozornění / Notice: Získané informace nemohou být použity k výdělečným účelům nebo vydávány za studijní, vědeckou nebo jinou tvůrčí činnost jiné osoby než autora. / Any retrieved information shall not be used for any commercial purposes or claimed as results of studying, scientific or any other creative activities of any person other than the author.

DSpace software copyright © 2002-2015  DuraSpace
Theme by 
@mire NV