Magyar jelentés-egyértelműsített korpusz

Szarvas György; Hatvani Csaba; Szauter Dóra; Almási Attila; Vincze Veronika; Csirik János: Magyar jelentés-egyértelműsített korpusz.

[thumbnail of msznykonf_005_158-165.pdf]

Előnézet

Cikk, tanulmány, mű
msznykonf_005_158-165.pdf
Letöltés (348kB) | Előnézet

Absztrakt (kivonat)

Az első magyar WSD korpusz elkészítéséhez 39 olyan szóalakot választottunk ki, melyek jó mintapéldák a jelentés-egyértelműsítés feladatának vizsgálatára. A kiválasztásnál a kritériumok között szerepelt, hogy az adott szóalak legyen gyakori a magyar nyelvben (ennek mérésére a Magyar Nemzeti Szövegtár (MNSZ) [8] gyakorisági adatait használtuk), illetve, hogy legyen több, használatában gyakorinak tekinthető jelentése. A korpusz szövegeit is az MNSZ-ből, annak Heti Világgazdaság (HVG) számaiból összeállított részkorpuszából válogattuk. Így minden egyes példához rendelkezésre áll a vizsgálat szempontjából releváns kontextus (teljes HVG-cikk), illetve automatikus tokenizálás, szófaji kódolás, szótőre vonatkozó információ.

Mű típusa:	Konferencia vagy workshop anyag
Befoglaló folyóirat/kiadvány címe:	Magyar Számítógépes Nyelvészeti Konferencia
Dátum:	2007
Kötet:	5
ISBN:	978-963-482-848-8
Oldalak:	pp. 158-165
Nyelv:	magyar
Konferencia neve:	Magyar Számítógépes Nyelvészeti Konferencia (5.) (2007) (Szeged)
Befoglaló mű URL:	http://acta.bibl.u-szeged.hu/58546/
Kulcsszavak:	Nyelvészet - számítógép alkalmazása
Megjegyzések:	Bibliogr.: 165. p. ; összefoglalás magyar nyelven
Feltöltés dátuma:	2019. jún. 18. 12:48
Utolsó módosítás:	2026. feb. 24. 08:10
URI:	http://acta.bibl.u-szeged.hu/id/eprint/58673

Bővebben:

Tétel nézet