Differences
This shows you the differences between two versions of the page.
Both sides previous revision Previous revision Next revision | Previous revision Next revision Both sides next revision | ||
user:zeman:wmt [2012/01/18 16:53] zeman Nová šablona (seed). |
user:zeman:wmt [2012/01/18 19:50] zeman Korpusové kroky. |
||
---|---|---|---|
Line 157: | Line 157: | ||
Dále vytvoří soubor '' | Dále vytvoří soubor '' | ||
- | Teprve v přípravném režimu se také vyrobí hlavní skript '' | + | Teprve v přípravném režimu se také vyrobí hlavní skript '' |
+ | |||
+ | ==== Korpusové kroky ==== | ||
+ | |||
+ | Některé kroky připravují části korpusů, které jsou pro experiment potřeba. Takový krok asi typicky bude přímo zasvěcen přípravě korpusu, ale není ani vyloučeno, že korpus bude vedlejším produktem jiné činnosti. Každopádně pokud je výsledkem nebo jedním z výsledků kroku korpus, je vhodné ve složce daného kroku založit soubor '' | ||
+ | |||
+ | ==== Sestavování experimentu jako posloupnosti kroků ==== | ||
+ | |||
+ | Pokusit se alespoň zpočátku využít existující kroky pro alignment, jazkový model apod. a nekonvertovat ty svoje. Vytvořit nějakou šablonu '' | ||
+ | * binarizace korpusu a alignmentu | ||
+ | * extrakce gramatiky pro vývojová i testovací data (jeden, nebo dva různé kroky?); analogicky ke kroku '' | ||
+ | * volání dekodéru Joshuy ('' | ||
+ | * asi i nějaká úprava mertu, byť současný eman už samozřejmě obsahuje konfiguraci mertu pro Mosese |