- Tytuł:
-
Automatic indexing of information resources concerning agriculture in Polish
Automatyczne indeksowanie zasobów informacyjnych w języku polskim dotyczących rolnictwa - Autorzy:
-
Karwowski, W.
Wrzeciono, P. - Powiązania:
- https://bibliotekanauki.pl/articles/93584.pdf
- Data publikacji:
- 2014
- Wydawca:
- Polskie Towarzystwo Inżynierii Rolniczej
- Tematy:
-
indexing
integrating sources of information
semantic network
knowledge management
indeksowanie
integrowanie źródeł informacji
sieć semantyczna
zarządzanie wiedzą - Opis:
-
Contemporary research and production activity require searching and collecting a variety of information, this also applies to issues in the field of agriculture. Today, the vast majority of resources are available in a digital form. FAO on the portal of the Agricultural Information Management Standards presents an AgroTagger, tool for indexing documents in the field of agriculture, which is designed for the English language. Extraction of knowledge is not very convenient in languages such as Polish language with a very extensive inflection. In Polish, the following parts of speech inflect: verbs, nouns, numerals, adjectives, and pronouns. Proper indexing requires an initial reduction of grammatical forms, to which the authors have used the dictionary of the Polish language and have developed a programme of reducing. Moreover the algorithms for determining weights corresponding to the validity of the appointments taking into account the prevalence of terms and their position in the document were developed and implemented.
Współcześnie działalność badawcza i produkcyjna wymaga wyszukiwania i gromadzenia różnorodnych informacji, dotyczy to także zagadnień z dziedziny rolnictwa. Obecnie większość zasobów dostępna jest w formie cyfrowej. FAO w ramach portalu Agricultural Information Management Standards prezentuje AgroTagger narzędzie do indeksowania dokumentów z dziedziny rolnictwa, które przeznaczone jest dla języka angielskiego. Ekstrakcja wiedzy jest utrudniona w językach takich jak język polski, posiadających bardzo rozbudowaną fleksję. W języku polskim odmienia się rzeczowniki, czasowniki, przymiotniki oraz zaimki osobowe. Właściwa indeksacja wymaga wstępnej redukcji form fleksyjnych, wobec czego wykorzystano słownik odmian języka polskiego i opracowano program redukujący. Ponadto opracowano i zaimplementowano algorytmy wyznaczania wag odpowiadających ważności terminów uwzględniające częstość występowania terminów i ich pozycję w dokumencie. - Źródło:
-
Agricultural Engineering; 2014, 18, 4; 103-110
2083-1587 - Pojawia się w:
- Agricultural Engineering
- Dostawca treści:
- Biblioteka Nauki