Magyar jelentés-egyértelműsített korpusz

Szarvas, György and Hatvani, Csaba and Szauter, Dóra and Almási, Attila and Vincze, Veronika and Csirik, János: Magyar jelentés-egyértelműsített korpusz. In: Magyar Számítógépes Nyelvészeti Konferencia, (3). pp. 158-165. (2007)

[img] Cikk, tanulmány, mű
msznykonf_005_158-165.pdf

Download (348kB)

Abstract

Az első magyar WSD korpusz elkészítéséhez 39 olyan szóalakot választottunk ki, melyek jó mintapéldák a jelentés-egyértelműsítés feladatának vizsgálatára. A kiválasztásnál a kritériumok között szerepelt, hogy az adott szóalak legyen gyakori a magyar nyelvben (ennek mérésére a Magyar Nemzeti Szövegtár (MNSZ) [8] gyakorisági adatait használtuk), illetve, hogy legyen több, használatában gyakorinak tekinthető jelentése. A korpusz szövegeit is az MNSZ-ből, annak Heti Világgazdaság (HVG) számaiból összeállított részkorpuszából válogattuk. Így minden egyes példához rendelkezésre áll a vizsgálat szempontjából releváns kontextus (teljes HVG-cikk), illetve automatikus tokenizálás, szófaji kódolás, szótőre vonatkozó információ.

Item Type: Article
Journal or Publication Title: Magyar Számítógépes Nyelvészeti Konferencia
Date: 2007
Volume: 3
ISBN: 978-963-482-848-8
Page Range: pp. 158-165
Event Title: Magyar Számítógépes Nyelvészeti Konferencia (5.) (2007) (Szeged)
Uncontrolled Keywords: Nyelvészet - számítógép alkalmazása
Additional Information: Bibliogr.: 165. p. ; összefoglalás magyar nyelven
Date Deposited: 2019. Jun. 18. 12:48
Last Modified: 2019. Jun. 18. 12:48
URI: http://acta.bibl.u-szeged.hu/id/eprint/58673

Actions (login required)

View Item View Item