Differences
This shows you the differences between two versions of the page.
Both sides previous revision Previous revision Next revision | Previous revision Next revision Both sides next revision | ||
user:hladka:vladimir-rovensky [2008/04/27 19:28] vladimir.rovensky |
user:hladka:vladimir-rovensky [2008/05/19 09:59] hladka |
||
---|---|---|---|
Line 2: | Line 2: | ||
| | ||
| | ||
+ | * Co vše má obsahovat pilotní verze? | ||
+ | * **Rešerše** - provést rešerši, jestli se podobným problémem již někdo zabýval; pokud ano, tak pro jaké jazyky a jakou metodologií. Rešerši zpracovat písemně. | ||
+ | * **Kód** | ||
+ | * **Dokumentace** | ||
+ | * Uživatelská - specifikace softwarových a hardwarových požadavků; | ||
+ | popis ukázky spuštění programu na souboru vět, popsat vyhodnocení úspěšnosti systému | ||
+ | * Programátorská - popis datových struktur | ||
+ | |||
+ | |||
====== Schůzky ====== | ====== Schůzky ====== | ||
* 3/3/2008 | * 3/3/2008 | ||
+ | * **navrhuji schuzku 15/5/2008 nekdy dopoledne (je mi to jedno)** | ||
====== Vzkazy ====== | ====== Vzkazy ====== | ||
* 16/3/2008 U mě v kaslíku na sekretariátu ÚFAL (MS, místnost č. 408) máte nachystané CD-ROM (píše se o něm v zadání) a popis morfologických značek. | * 16/3/2008 U mě v kaslíku na sekretariátu ÚFAL (MS, místnost č. 408) máte nachystané CD-ROM (píše se o něm v zadání) a popis morfologických značek. | ||
+ | |||
+ | |||
+ | |||
+ | |||
+ | |||
+ | |||
Line 17: | Line 32: | ||
* Smim ve vystupu tool-chainu pouzivat tagy <g> a <r> ? __Ne. To jsou informace pro syntax.__ (// | * Smim ve vystupu tool-chainu pouzivat tagy <g> a <r> ? __Ne. To jsou informace pro syntax.__ (// | ||
* Je nekde k dispozici cesky preklad tahaku ke znackam tagu <t>, pripadne vysvetlivky k nim ? __Ano - [[http:// | * Je nekde k dispozici cesky preklad tahaku ke znackam tagu <t>, pripadne vysvetlivky k nim ? __Ano - [[http:// | ||
+ | * Pri uvodni schuzce se hovorilo o sade vet urcenych k testovani programu, da se nekde stahnout? __Ano, vety budou k dispozici. Budou to vety z Ceskeho akademickeho korpusu 2.0. Prace na tomto korpusu finisuje. Az se dodelaji vsechny kontroly, tak pripravim dva soubory ve formatu csts: jeden se smysluplnymi vetami a druhy s nesmysluplnymi vetami. Soubory budou k dispozici nejpozdeji pristi tyden ve stredu.__ | ||
+ | * Co by mela splnovat specifikace programu(delka, | ||
+ | | ||
==Prvni naznak algoritmu== | ==Prvni naznak algoritmu== | ||
- Rozparsovat vstup z tool-chainu - pravdepodobne staci chytat tagy <f> a v nich <t>, mozna by se hodily i <r> a <g> (id tokenu + ukazatel na nadrazeny token) ale asi to nespada do morfologie. __tool_chain na vystupu nevydava <t>, pokud je v datech <t>, tak obsahuje znacku doplnenou rucne, tedy lidmi. tool_chain dava na vystupu < | - Rozparsovat vstup z tool-chainu - pravdepodobne staci chytat tagy <f> a v nich <t>, mozna by se hodily i <r> a <g> (id tokenu + ukazatel na nadrazeny token) ale asi to nespada do morfologie. __tool_chain na vystupu nevydava <t>, pokud je v datech <t>, tak obsahuje znacku doplnenou rucne, tedy lidmi. tool_chain dava na vystupu < | ||
Line 49: | Line 67: | ||
==Dale== | ==Dale== | ||
Vymyslet zapojeni spojek, castic, citoslovci, pripadne podrobnejsi rozdeleni vety na casti (podmetna, prisudkova, | Vymyslet zapojeni spojek, castic, citoslovci, pripadne podrobnejsi rozdeleni vety na casti (podmetna, prisudkova, | ||
- | Zda se ze smysluplnost program vetsinou rozezna, trochu horsi je to s nesmyslnymi vetami, domyslim. | + | Zda se ze smysluplnost program vetsinou rozezna, trochu horsi je to s nesmyslnymi vetami |