Differences
This shows you the differences between two versions of the page.
Both sides previous revision Previous revision Next revision | Previous revision Next revision Both sides next revision | ||
user:zeman:dz-parser:conll [2008/04/29 13:04] zeman Srovnání konfigurací parseru. |
user:zeman:dz-parser:conll [2009/03/03 16:28] zeman Makefile. |
||
---|---|---|---|
Line 20: | Line 20: | ||
===== Zpracování ===== | ===== Zpracování ===== | ||
+ | |||
+ | Zpracování má dvě části. První se týká přípravy dat, jejich převodu do formátu CSTS apod. Tato část není bezprostředně závislá na konkrétním parseru a odehrává se přímo ve složce s& | ||
Každý jazyk zkouším zpracovat jednak s& | Každý jazyk zkouším zpracovat jednak s& | ||
Line 40: | Line 42: | ||
===== Výsledky ===== | ===== Výsledky ===== | ||
+ | |||
==== Výchozí nastavení ==== | ==== Výchozí nastavení ==== | ||
Line 50: | Line 53: | ||
| bg | 2006 | 72.3 | | | bg | 2006 | 72.3 | | ||
| ca | 2007 | 72.7 | | | ca | 2007 | 72.7 | | ||
+ | | ca | 2009 | 73.6 | | ||
| cs | 2006 | 64.1 | | | cs | 2006 | 64.1 | | ||
| cs | 2007 | 69.1 | | | cs | 2007 | 69.1 | | ||
+ | | cs | 2009 | 65.8 | | ||
| da | 2006 | 69.9 | | | da | 2006 | 69.9 | | ||
| de | 2006 | 71.8 | | | de | 2006 | 71.8 | | ||
+ | | de | 2009 | 72.3 | | ||
| el | 2007 | 65.0 | | | el | 2007 | 65.0 | | ||
| en | 2007 | 70.6 | | | en | 2007 | 70.6 | | ||
+ | | en | 2009 | 69.5 | | ||
+ | | es | 2009 | 71.8 | | ||
| eu | 2007 | 58.6 | | | eu | 2007 | 58.6 | | ||
| hu | 2007 | 62.3 | | | hu | 2007 | 62.3 | | ||
| it | 2007 | 71.5 | | | it | 2007 | 71.5 | | ||
| ja | 2006 | 87.3 | | | ja | 2006 | 87.3 | | ||
+ | | ja | 2009 | 83.2 | | ||
| nl | 2006 | 73.7 | | | nl | 2006 | 73.7 | | ||
| pt | 2006 | 73.8 | | | pt | 2006 | 73.8 | | ||
Line 67: | Line 76: | ||
| zh | 2006 | 69.9 | | | zh | 2006 | 69.9 | | ||
| zh | 2007 | 69.0 | | | zh | 2007 | 69.0 | | ||
+ | | zh | 2009 | 57.7 | | ||
Následující tabulka srovnává výsledky s původními značkami CoNLL a výsledky se značkami PDT. Data jsou dtest. Nastavení parseru je výchozí, tj. úprava značek ani selektivní lexikalizace není zapnuta. Poslední sloupec říká, zda je změna úspěšnosti statisticky významná podle McNemarova testu na úrovni 0,05 (χ< | Následující tabulka srovnává výsledky s původními značkami CoNLL a výsledky se značkami PDT. Data jsou dtest. Nastavení parseru je výchozí, tj. úprava značek ani selektivní lexikalizace není zapnuta. Poslední sloupec říká, zda je změna úspěšnosti statisticky významná podle McNemarova testu na úrovni 0,05 (χ< |