×

Serwis używa ciasteczek ("cookies") i podobnych technologii m.in. do utrzymania sesji i w celach statystycznych. • Ustawienia przeglądarki dotyczące obsługi ciasteczek można swobodnie zmieniać. • Całkowite zablokowanie zapisu ciasteczek na dysku komputera uniemożliwi logowanie się do serwisu. • Więcej informacji: Polityka cookies OPI PIB

×

Regulamin korzystania z serwisu PBN znajduję się pod adresem: Regulamin serwisu

Szukaj wśród:
Dane publikacji

A modular metadata extraction system for born-digital articles

Rozdział
Dominika Tkaczyk [1] , Łukasz Bolikowski [1] , Artur Czeczko [1] , Krzysztof Rusek [1]
2012 angielski
Link do publicznie dostępnego pełnego tekstu
Identyfikatory
-
Cechy publikacji
-
  • Zrecenzowana naukowo
  • Konferencyjna
Dane konferencji
-
  1. DAS '12 10th IAPR International Workshop on Document Analysis Systems
  2. 2012-03-27 - 2012-03-29
  3. Gold Coast, Queensland, Australia
Abstrakty ( angielski )
-
We present a comprehensive system for extracting metadata from scholarly articles. In our approach the entire document is inspected, including headers and footers of all the pages as well as bibliographic references. The system is based on a modular workflow which allows for evaluation, unit testing and replacement of individual components. The workflow is optimized towards processing of born-digital documents, but may accept scanned document images as well. The machine-learning approaches we have chosen for solving individual tasks increase the ability to adapt to new document layouts and formats. The evaluation tests we have performed showed good results of the individual implementations and the entire metadata extraction process.
Zacytuj dokument
-