Differences
This shows you the differences between two versions of the page.
Both sides previous revision Previous revision Next revision | Previous revision Next revision Both sides next revision | ||
user:zeman:wmt [2012/02/28 13:47] zeman Aktualizace úkolů. |
user:zeman:wmt [2012/02/29 13:46] zeman Doběhlo de-cs. |
||
---|---|---|---|
Line 109: | Line 109: | ||
Nový průběh všech osmi starých pokusů (supervised truecasing, žádná normalizace uvozovek, nové je na nich paralelní počítání alignmentu, ale výsledek by měl být identický – nekontroloval jsem): '' | Nový průběh všech osmi starých pokusů (supervised truecasing, žádná normalizace uvozovek, nové je na nich paralelní počítání alignmentu, ale výsledek by měl být identický – nekontroloval jsem): '' | ||
+ | |||
+ | **Šest přídavných jazykových párů: čeština s němčinou, španělštinou a francouzštinou.** Tyto jazykové páry nejsou součástí shared task. Organizátoři pro ně ani neposkytují trénovací data, ale ta je možné získat hledáním shodných vět v& | ||
^ Jazyky ^ v6 ^ v6b-tr ^ v6b ^ v7 ^ wmt12 ^ | ^ Jazyky ^ v6 ^ v6b-tr ^ v6b ^ v7 ^ wmt12 ^ | ||
Line 119: | Line 121: | ||
| en-fr | 0.2591 | 0.2619 | 0.2526 | 0.2729 | 0.2572 | | | en-fr | 0.2591 | 0.2619 | 0.2526 | 0.2729 | 0.2572 | | ||
| fr-en | 0.2243 | 0.2285 | 0.2384 | 0.2448 | 0.2391 | | | fr-en | 0.2243 | 0.2285 | 0.2384 | 0.2448 | 0.2391 | | ||
+ | | cs-de | | | | | 0.1304 | | ||
+ | | de-cs | | | | | 0.1186 | | ||
+ | | cs-es | | | | | 0.1848 | | ||
+ | | es-cs | | | | | 0.1220 | | ||
+ | | cs-fr | | | | | 0.1822 | | ||
+ | | fr-cs | | | | | 0.1175 | | ||
===== Pokusy s Emanem ===== | ===== Pokusy s Emanem ===== | ||
Line 164: | Line 172: | ||
(Ondřej měl s Mosesem asi 0.1230.) | (Ondřej měl s Mosesem asi 0.1230.) | ||
Ještě je potřeba to testovat stejným skriptem jako Ondřej, abychom použili stejnou tokenizaci a taky abychom dostali rozptyl skóre. | Ještě je potřeba to testovat stejným skriptem jako Ondřej, abychom použili stejnou tokenizaci a taky abychom dostali rozptyl skóre. | ||
- | |||
- | ===== Čeština s němčinou, španělštinou a francouzštinou ===== | ||
- | |||
- | Tyto jazykové páry nejsou součástí shared task. Organizátoři pro ně ani neposkytují trénovací data, ale ta je možné získat hledáním shodných vět v& | ||
- | |||
- | Není-li řečeno jinak, váhy se ladí na newstest2008 a testuje se na newstest2009. Trénuje se zatím na news-commentary, | ||
- | |||
- | | **Pokus** | **Dev WMT08** | **Test WMT09** | **Test WMT10** | **Poznámka** | **Datum** | | ||
- | | decs-josh13 | 0.0935 | 0.0886 | | | 15.3.2010 | | ||
- | | escs-josh13 | 0.0922 | 0.0872 | | | 15.3.2010 | | ||
- | | frcs-josh13 | 0.0885 | 0.0818 | | Zřetelně menší trénovací data než pro encs, decs a escs. | 15.3.2010 | | ||