BazEkon - Biblioteka Główna Uniwersytetu Ekonomicznego w Krakowie

BazEkon home page

Meny główne

Autor
Karwowski Waldemar (Warsaw University of Life Sciences - SGGW, Poland), Wrzeciono Piotr (Warsaw University of Life Sciences - SGGW, Poland)
Tytuł
Automatic indexing of information resources concerning agriculture in Polish
Automatic indexing of information resources concerning agriculture in Polish
Źródło
Agricultural Engineering, 2014, R. 18, nr 4 (152), s. 103-110, rys., bibliogr. 14 poz.
Słowa kluczowe
Źródła informacji, Rolnictwo, Sieć semantyczna
Information source, Agriculture, Semantic Web Service (SWS)
Uwagi
summ., streszcz.
Abstrakt
Współcześnie działalność badawcza i produkcyjna wymaga wyszukiwania i gromadzenia różnorodnych informacji, dotyczy to także zagadnień z dziedziny rolnictwa. Obecnie większość zasobów dostępna jest w formie cyfrowej. FAO w ramach portalu Agricultural Information Management Standards prezentuje AgroTagger narzędzie do indeksowania dokumentów z dziedziny rolnictwa, które przeznaczone jest dla języka angielskiego. Ekstrakcja wiedzy jest utrudniona w językach takich jak język polski, posiadających bardzo rozbudowaną fleksję. W języku polskim odmienia się rzeczowniki, czasowniki, przymiotniki oraz zaimki osobowe. Właściwa indeksacja wymaga wstępnej redukcji form fleksyjnych, wobec czego wykorzystano słownik odmian języka polskiego i opracowano program redukujący. Ponadto opracowano i zaimplementowano algorytmy wyznaczania wag odpowiadających ważności terminów uwzględniające częstość występowania terminów i ich pozycję w dokumencie.(abstrakt oryginalny)

Contemporary research and production activity require searching and collecting a variety of information, this also applies to issues in the field of agriculture. Today, the vast majority of resources are available in a digital form. FAO on the portal of the Agricultural Information Management Standards presents an AgroTagger, tool for indexing documents in the field of agriculture, which is designed for the English language. Extraction of knowledge is not very convenient in languages such as Polish language with a very extensive inflection. In Polish, the following parts of speech inflect: verbs, nouns, numerals, adjectives, and pronouns. Proper indexing requires an initial reduction of grammatical forms, to which the authors have used the dictionary of the Polish language and have developed a programme of reducing. Moreover the algorithms for determining weights corresponding to the validity of the appointments taking into account the prevalence of terms and their position in the document were developed and implemented.(original abstract)
Pełny tekst
Pokaż
Bibliografia
Pokaż
  1. AgroTagger. Pozyskano z: http://aims.fao.org/agrotagger.
  2. Branny, E. (2005). Text Summarizing in Polish. Praca magisterska Wydział Elektrotechniki, Automatyki, Informatyki i Elektroniki. AGH Kraków (niepublikowana).
  3. Dolamic, L.; Savoy, J. (2008). Stemming Approaches for East European Languages. Advances in Multilingual and Multimodal Information Retrieval, Springer LNCS vol. 5152, 37-44.
  4. Gupta, S.; Manning, C.D. (2011). Analyzing the Dynamics of Research by Extracting Key Aspects of Scientific Papers. Proceedings of the Fifth International Joint Conference on Natural Language Processing. Pozyskano z: http://nlp.stanford.edu/pubs/gupta-manning-ijcnlp11.pdf.
  5. Karwowski, W. (2010). Ontologies and Agricultural Information Management Standards. Information systems in managment VI, ed. P. Jałowiecki & A. Orłowski. WULS Press, Warszawa, 49-56.
  6. Lovins, J. (1968). Development of a Stemming Algorithm, Mechanical Translation and Computational Linguistics 11(1-2), 11-31.
  7. Manning, C.D., (2011). Part-of-Speech Tagging from 97% to 100%: Is It Time for Some Linguistics?. Computational Linguistics and Intelligent Text Processing, Part I. Springer LNCS vol. 6608, 171-189.
  8. Manning, C.D.; Raghavan, P.; Schuetze, H. (2008). Introduction to Information Retrieval. Cambridge University Press. ISBN: 0521865719.
  9. Paice, C.; Husk, G. (1990). Another Stemmer. ACM SIGIR Forum 24(3), 56-61.
  10. Porter, M. (1980). An algorithm for suffix stripping, Program 14(3), 130-137.
  11. Słownik Języka Polskiego. Pozyskano z: http://www.sjp.pl.
  12. Tezaurus AGROVOC. Pozyskano z: http://aims.fao.org/standards/agrovoc/about/.
  13. Weres, J. (2010). Informatyczny system pozyskiwania danych o geometrii produktów rolniczych na przykładzie ziarniaka kukurydzy. Inżynieria Rolnicza, 7, 229-236.
  14. Wrzeciono P., Karwowski W. (2013). Automatic Indexing and Creating Semantic Networks for Agricultural Science Papers in the Polish Language. Computer Software and Applications Conference Workshops (COMPSACW). 2013 IEEE 37th Annual, Kyoto.
Cytowane przez
Pokaż
ISSN
1429-7264
Język
eng
URI / DOI
http://dx.medra.org/10.14654/ir.2014.152.85
Udostępnij na Facebooku Udostępnij na Twitterze Udostępnij na Google+ Udostępnij na Pinterest Udostępnij na LinkedIn Wyślij znajomemu