Diplomová práce

Vybraný problém homonymie slovesných tvarů z hlediska automatické morfologické analýzy (homonymie tvarů sloves I. třídy (vzor nést, péci) a II. třídy (vzor tisknout): substandardní tvary l-ových příčestí a dějová jména potažmo tvary mask. sg. přechodníku přítomného)

Homonymy of the verb forms as a problem of authomatical morfological analysis of Czech

Bc. Adriana Babincová, učo 415719
Anotace

Předkládaná magisterská diplomová práce se zaměřuje na problematiku homonymie v českém morfologickém systému sloves. Cílem práce je zachytit chybně disambiguované homonymní tvary I. a II. slovesné třídy, které mohou mít jak slovesnou, tak substantivní interpretaci, konkrétně interpretaci tvaru l-ového příčestí nebo dějového substantiva, popřípadě přechodníku minulého, a získat tak přehled o míře homonymie …více

Abstract

This master's thesis is concentrating on homonymy in the Czech morphological verb system. The purpose of the thesis is to capture the incorrectly disambiguated homonymous shapes of I. and II. Verbal classes that can have verbal and substantive interpretations, specifically the interpretation of the form of a past participle or a verbal noun, to determine the homonymy range and the incorrect disambiguation …více

Zadání práce
Práce se zaměří na jeden z problémů systémové tvarové homonymie českých sloves. Konkrétně půjde o homonymii tvarů sloves I. třídy (vzor nést, péci) a II. třídy (vzor tisknout): substandardní tvary l-ových příčestí a dějová jména potažmo tvary mask. sg. přechodníku přítomného. Příklad: vlek se k potoku/ u potoka postavili vlek. Cílem práce bude a) korpusová analýza současného stavu morfologického značkování (přítomnost/nepřítomnost tvaru slovesa ve slovníku automatického morfologického analyzátoru a následné nerozpoznání tvarů automatickou morfologickou analýzou), b) analýza disambiguace případů zaznamenaných morfologickou analýzou a disambiguovaných. Na základě pozorování takto vytříděných korpusových dat se práce zaměří na c) případné návrhy na zařazení nerozpoznaných tvarů do slovníku automatického analyzátoru se stálým zřetelem k možným problémům disambiguace a d) návrh pravidel pro odstranění chybné disambiguace. Student bude pracovat s korpusy řady SYN a výsledky morfologické analýzy ve značkování těchto korpusů. Bude využívat www rozhraní KonText a nástroj Morfio. Dále bude pracovat i s korpusy a korpusovými nástroji budovanými na FI MU (webový korpus CzTenTen12 a Deriv). Součástí práce budou přehledy slovesných lemmat a tvarů, které bude možné využít a) jako podklady pro vylepšení stávajících slovníků automatických morfologických analyzátorů a b) jako zdroj informací pro uživatele jazykových korpusů, kteří chtějí hlouběji proniknout do mezí a možností stávajícího značkování na rovině automatické morfologické analýzy češtiny.
Práce zkontrolována:
7. 8. 2017 12:11, prof. PhDr. Klára Osolsobě, Dr., učo 1996
Plný text práce
1,5 MB / soubor PDF
Jazyk práce
čeština čeština
Termín obhajoby
8. 9. 2017
Práce byla úspěšně obhájena

Vedoucí

prof. PhDr. Klára Osolsobě, Dr., učo 1996
ÚČJ FF MU

Oponent

Mgr. Kateřina Najbrtová, Ph.D., učo 145034
ÚČJ FF MU

  • Přidání souboru

    Soubor nebo složku lze nahrát pomocí tlačítka Přidat.
  • Další operace se soubory

    Podrobnosti lze zjistit označením příslušného řádku.
  • Pohled pro experty

    Pro častou práci je možné zvolit režim Více možností.
  • Vyhledávání souborů

    Vyhledávaný výraz můžete zadat přímo do adresního řádku.
  • Rychlý přístup k souborům

    Pomocí funkce Nedávné je možné se rychle vrátit k právě prohlíženým souborům. Oblíbené soubory je také možné označit Hvězdičkou.