Szarvas György; Hatvani Csaba; Szauter Dóra; Almási Attila; Vincze Veronika; Csirik János: Magyar jelentés-egyértelműsített korpusz.
Előnézet |
Cikk, tanulmány, mű
msznykonf_005_158-165.pdf Letöltés (348kB) | Előnézet |
Absztrakt (kivonat)
Az első magyar WSD korpusz elkészítéséhez 39 olyan szóalakot választottunk ki, melyek jó mintapéldák a jelentés-egyértelműsítés feladatának vizsgálatára. A kiválasztásnál a kritériumok között szerepelt, hogy az adott szóalak legyen gyakori a magyar nyelvben (ennek mérésére a Magyar Nemzeti Szövegtár (MNSZ) [8] gyakorisági adatait használtuk), illetve, hogy legyen több, használatában gyakorinak tekinthető jelentése. A korpusz szövegeit is az MNSZ-ből, annak Heti Világgazdaság (HVG) számaiból összeállított részkorpuszából válogattuk. Így minden egyes példához rendelkezésre áll a vizsgálat szempontjából releváns kontextus (teljes HVG-cikk), illetve automatikus tokenizálás, szófaji kódolás, szótőre vonatkozó információ.
Mű típusa: | Konferencia vagy workshop anyag |
---|---|
Befoglaló folyóirat/kiadvány címe: | Magyar Számítógépes Nyelvészeti Konferencia |
Dátum: | 2007 |
Kötet: | 5 |
ISBN: | 978-963-482-848-8 |
Oldalak: | pp. 158-165 |
Konferencia neve: | Magyar Számítógépes Nyelvészeti Konferencia (5.) (2007) (Szeged) |
Befoglaló mű URL: | http://acta.bibl.u-szeged.hu/58546/ |
Kulcsszavak: | Nyelvészet - számítógép alkalmazása |
Megjegyzések: | Bibliogr.: 165. p. ; összefoglalás magyar nyelven |
Feltöltés dátuma: | 2019. jún. 18. 12:48 |
Utolsó módosítás: | 2022. nov. 08. 11:50 |
URI: | http://acta.bibl.u-szeged.hu/id/eprint/58673 |
Tétel nézet |