[ Skip to the content ]

Institute of Formal and Applied Linguistics Wiki


[ Back to the navigation ]

Differences

This shows you the differences between two versions of the page.

Link to this comparison view

Both sides previous revision Previous revision
Next revision
Previous revision
Next revision Both sides next revision
anotace-rozsirene-koreference [2008/11/12 22:23]
ufal
anotace-rozsirene-koreference [2012/04/11 15:40]
ufal
Line 2: Line 2:
 Anotace rozšířené koreference je projekt anotace jmenné koreference a asociační anafory (bridging anaphora) na PDT. Anotace rozšířené koreference je projekt anotace jmenné koreference a asociační anafory (bridging anaphora) na PDT.
  
 +===== PDT 2.0 =====
  
  
 +
 +===== Dokumenty =====
 +  * Manuálek k anotaci rozšířené koreference (stručná verze): [[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/manual_RK_kratky.pdf| PDF]]
 +  * Manuálek k anotaci rozšířené koreference (podrobná neupravená verze, 6.12.):[[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/projekt_anotace.pdf | PDF]] 
 +  * Koreference NP s abstraktním významem (**verze 6.12.**): [[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/table_abstr.doc | DOC]]
 +   * //**NEW!**// [[Příklady k zatím nezavedené bridging skupině ANOF|Příklady k zatím nezavedené bridging skupině ANAF]] (nekoreferenční anafora - metajazyk, //takový// apod.)
 +  * Mezianotatorska neshoda [[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/neshoda.pdf | PDF]]
 +
 +   
  
  
  
  
-===== Dokumenty ===== 
-  * Manuálek k anotaci rozšířené koreference (aktuální verze): [[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/projekt_anotace.pdf | PDF]] 
-  * Otázky - odpovědi - diskuze (do 6.11.): [[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/otazky_odpovedi_diskuze.doc| DOC]] 
-  * Koreference NP s abstraktním významem: [[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/table_abstr.doc | DOC]] 
  
  
 ===== Anotátoři ===== ===== Anotátoři =====
  
- * **JK**: Jan Křiván +  * **RO**: Radek Ocelák  
- * **RO**: Radek Ocelák +  * **JP**: Jiří Pergler  
- * **JP**: Jiří Pergler  +  * **AN**: Аня Hедолужко 
- * **AN**: Аня Hедолужко+  * (dříve také: **JK**: Jan Křivan)
  
  
 +
 +
 +
 +
 +
 +
 +
 +
 +
 +
 +===== Diskuze =====
 +
 +[[Diskuze]] na samostatné stránce.
 +
 +
 +
 +===== Data =====
 +
 +[[Přehled o anotovaných datech]] na samostatné stránce.
 +
 +[[(Polo-)automatické kontroly dat]] na samostatné stránce.
 +
 +
 +
 +
 +
 +
 +
 +===== Zajímavé/problematické řetězce =====
 +
 +[[Problemy|Zajímavé/problematické řetězce]] na samostatné stránce
 +
 +
 +
 +
 +
 +===== Rozšíření TrEdu =====
 +
 +Pro TrEd existuje rozšíření pro anotaci rozšířené textové koreference a bridging anaphory:
 +
 +[[Rozsireni Tredu|Rozšíření TrEdu]] - na samostatné stránce
 +
 +===== PEDT 2.0 =====
 +
 +
 +
 +
 +
 +
 +
 +
 +
 +
 +
 +
 +
 +
 +
 +
 +===== Dokumenty =====
 +  * Manuálek k anotaci rozšířené koreference (stručná verze): [[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/manual_RK_kratky.pdf| PDF]]
 +  * Manuálek k anotaci rozšířené koreference (podrobná neupravená verze, 6.12.):[[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/projekt_anotace.pdf | PDF]] 
 +  * Koreference NP s abstraktním významem (**verze 6.12.**): [[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/table_abstr.doc | DOC]]
 +   * //**NEW!**// [[Příklady k zatím nezavedené bridging skupině ANOF|Příklady k zatím nezavedené bridging skupině ANAF]] (nekoreferenční anafora - metajazyk, //takový// apod.)
 +  * Mezianotatorska neshoda [[http://ufal.mff.cuni.cz/~nedoluzko/koref_anot/neshoda.pdf | PDF]]
 +
 +   
 +
 +
 +
 +
 +
 +
 +===== Anotátoři =====
 +
 +  * **RO**: Radek Ocelák 
 +  * **JP**: Jiří Pergler 
 +  * **AN**: Аня Hедолужко
 +  * (dříve také: **JK**: Jan Křivan)
  
  
Line 35: Line 120:
  
 ===== Diskuze ===== ===== Diskuze =====
-|              ^ problém            ^ diskuze, řešení          ^ techn.pozn.        ^ + 
-^ schůzka_6.11    | řetězec Petr – to dítě – Petr: opačný vztah hyperonymie.          | řetězec Petr – to dítě {coref_text, typ SYN na “Petr”} – Petr {coref_text, typ SYN na “dítě“}ER zatím nerušíme, ale zahrnujeme tam pouze příklady lexikální hyperonymie (viz příklady v manuálku) a odkazy na slovesa a situace (viz tamtéž). „Petr – dítě“ tak spadá do SYN jako jiné slovní označení.  -------------- RO: Vždyť to ale byl ten hlavní případ, Anjo, kvůli kterému jsi chtěla zachovat ER; že se to chová jinak. Zbylé případy zvláštní kategorii myslím nevyžadují už vůbec. Co ji tedy opravdu zrušit?    | | +[[Diskuze]] na samostatné stránce
-^ schůzka_6.11    | adjektiva odvozené od pojmenovaných entit, typu německý. Často nejde jednoznačně rozhodnout, jestli se dané „německý“ vztahuje k Německu a má tedy být označeno, nebo třeba k Němcům, nebo vůbec k širší množině (jako německý jazyk apod.)| řešíme, zatím anotovat (jak typy Novak-Novakuv tak i Praha-prazsky)                   | | +
-^ schůzka_6.11    | „leden – červen“. … „ve stejném období loňského roku“. Ve stejném období – jednoznačná koherence, odkaz na „leden – červen“, ale nemáme nástroj pro její označení.          | je tu anafora, ale není koreference. Odkazujeme na místo v kalendáři. Docela typický příklad. Zatím nabízím bridging_REST, protože anotujeme hlavně koreferenci a nemůžeme propojit identitou páry, které nejsou koreferenční.        |  +
-^ dotaz RO     Je vhodné začínat koreferenční řetězce už u uzlů z nadpisu článku? Moc se mi to nezdá - často jimi žádná jasná reference ještě nevzniká, jsou vytvářeny až po textu a spíš do něj odkazují.   Př. nadpis "Cizinec jako našinec", v textu pak jde o zahraniční klienty lázní v Karlových Varech. Nešlo by třeba vést šipku naopak, jakoby kataforu? Popř. paušálně nadpisy neoznačovat? Někde se to ale jako antecedent dá brát - když je třeba v nadpisu "Václav Klaus".|      | |+
  
  
 ===== Data ===== ===== Data =====
 +
 +[[Přehled o anotovaných datech]] na samostatné stránce.
 +
 +[[(Polo-)automatické kontroly dat]] na samostatné stránce.
 +
 +
  
  
Line 48: Line 137:
  
  
 +===== Zajímavé/problematické řetězce =====
  
 +[[Problemy|Zajímavé/problematické řetězce]] na samostatné stránce
  
  
Line 54: Line 145:
  
  
-==== Train-1 ====+===== Rozšíření TrEdu =====
  
-^ data ^ # souborů ^ # vět ^ # slov ^ anotátor ^ odesláno ^ vráceno ^ soubory ^ +Pro TrEd existuje rozšíření pro anotaci rozšířené textové koreference a bridging anaphory:
-| data_20081016_Anja.zip | 28 | 479 | 7190 | AN | 16.10.2008 | - | cmpr9410_001 - lnd94103_106 | +
-| data_20081016_Radek_Ocelak.zip | 31 | 498 | 8922 | RO | 16.10.2008 | 10.11.2008 | lnd94103_116 - ln94202_75 | +
-| data_20081016_Jan_Krivan.zip | 31 | 496 | 9305 | JK | 16.10.2008 | - | ln94202_84 - ln94204_78 | +
-| data_20081016_Jiri_Pergler.zip | 24 | 246 | 4068 | JP | 16.10.2008 | 6.11.2008 | ln94204_87 - ln94206_29 | +
-| data_20081105_test_shody.zip | 3 | 41 | 585 | AN | 5.11.2008 | - | ln94206_38, ln94206_56, mf920922_044 | +
-| data_20081105_test_shody.zip | 3 | 41 | 585 | RO | 5.11.2008 | 10.11.2008 | ln94206_38, ln94206_56, mf920922_044 | +
-| data_20081105_test_shody.zip | 3 | 41 | 585 | JK | 5.11.2008 | - | ln94206_38, ln94206_56, mf920922_044 | +
-| data_20081105_test_shody.zip | 3 | 41 | 585 | JP | 5.11.2008 | - | ln94206_38, ln94206_56, mf920922_044 | +
-| data_20081106_Radek_Ocelak.zip | 41 | 816 | 13178 | RO | 6.11.2008 | - | ln94206_47, ln94206_65 - ln94209_50 | +
-| data_20081106_Jan_Krivan.zip | 63 | 801 | 14566 | JK | 6.11.2008 | - | ln94209_6 - ln95047_051 | +
-| data_20081106_Jiri_Pergler.zip | 19 | 404 | 6862 | JP | 6.11.2008 | - | ln95047_061 - ln95048_102 |+
  
 +[[Rozsireni Tredu|Rozšíření TrEdu]] - na samostatné stránce
  
-===== Zajimavé/problematické řetězce ===== 

[ Back to the navigation ] [ Back to the content ]