Differences
This shows you the differences between two versions of the page.
Both sides previous revision Previous revision | Next revision Both sides next revision | ||
user:zeman:malt-parser [2013/07/11 18:41] zeman Aktualizace úkolů. |
user:zeman:malt-parser [2013/07/11 18:49] zeman Odstraněny staré záznamy o pokusech bez splitting tricku. |
||
---|---|---|---|
Line 5: | Line 5: | ||
Od května 2012 používám Malt Parser 1.7.1 z& | Od května 2012 používám Malt Parser 1.7.1 z& | ||
- | Podle Joakima trénování na celém PDT trvá 3 až 5 dní, a to ještě jen při použití splitting | + | Podle Joakima trénování na celém PDT trvá 3 až 5 dní, a to ještě jen při použití splitting |
Celá trénovací data mají 68562 vět (někde mám chybně uvedeno 68563 kvůli nejasnostem s& | Celá trénovací data mají 68562 vět (někde mám chybně uvedeno 68563 kvůli nejasnostem s& | ||
Line 26: | Line 26: | ||
===== Nové výsledky s Malt Parserem 1.7 ===== | ===== Nové výsledky s Malt Parserem 1.7 ===== | ||
- | Měl jsem dva cíle: 1. Natrénovat nové modely, protože ty staré nejsou kompatibilní s novou verzí parseru, a 2. získat výsledky na e-testu, protože dosud jsem pracoval jen s d-testem. I když jsem novou verzi parseru pouštěl se stejnými parametry jako před třemi lety tu starou, dostal jsem jiné výsledky (nepatrně horší). | + | Experimenty probíhaly v& |
D-test (9270 vět): | D-test (9270 vět): | ||
Line 64: | Line 64: | ||
| 65000 | 1035255 | 5 dní 21:01 h | 31378 s = 8:43 h | 1 věta / 3,38 s | 85,96 % | 9.-15.4.2010 | | | 65000 | 1035255 | 5 dní 21:01 h | 31378 s = 8:43 h | 1 věta / 3,38 s | 85,96 % | 9.-15.4.2010 | | ||
| 68563 | 1177906, 1305554 | 10 dní 4:40 h | 46999 s = 13:03 h | 1 věta / 5,07 s | **86,08 %** | 27.4.-14.5.2010 | | | 68563 | 1177906, 1305554 | 10 dní 4:40 h | 46999 s = 13:03 h | 1 věta / 5,07 s | **86,08 %** | 27.4.-14.5.2010 | | ||
- | |||
- | Tohle je nejlepší výsledek, jaký jsem zatím s Malt parserem dosáhl, ale se splitting trickem (viz níže) je to téměř stejné a ušetří se dva dny času. | ||
- | |||
- | ===== Bez splitting tricku ===== | ||
- | |||
- | Trénování bez " | ||
- | |||
- | | Algoritmus | Délka trénování | Délka parsingu | Rychlost parsingu | Úspěšnost | | ||
- | | nivreeager | 24 dní 17 hodin 13 minut (2135575 s) | 180062 s (50:01 hodin) | 1 věta / 19,4 s | 80,73 % | | ||
- | | nivrestandard | 32 dní 16 hodin 47 minut (2825227 s) | 225021 s (62:30 hodin) | 1 věta / 24,3 s | 79,98 % | | ||
- | | covproj | 60 dní 15 hodin 28 minut (5239706 s) | 348001 s (96:40 hodin) | 1 věta / 37,5 s | 79,69 % | | ||
- | | covnonproj | Skončilo restartem fireball6 někdy v lednu nebo únoru 2010. V ''/ | ||
- | | stackproj | 42 dní 12 hodin 55 minut (3675303 s) | 183676 s (51:01 hodin) | 1 věta / 19,8 s | 78,49 % | | ||
- | | stacklazy | Skončilo chybou Java VM ('' | ||
- | | stackeager | 39 dní 11 hodin 38 minut (3375472 s) | 227927 s (63:19 hodin) | 1 věta / 24,6 s | 82,93 % | | ||
===== Nastavení od Švédů ===== | ===== Nastavení od Švédů ===== |