Zadání, která můžete rovnou použít
Pět hotových zadání pro práci s matrikami v umělé inteligenci, která můžete zkopírovat a rovnou použít pro přepis i kontrolu rodokmenu.
11 minut čtení
Proč obecné dotazy selhávají
Při práci se starými matrikami nestačí do chatu napsat prosté „Přečti mi tento zápis". Jazykový model má sklon nabídnout hladkou a přesvědčivou odpověď i tam, kde si jistý není. Když narazí na rozmazané písmo, poškozený papír nebo vybledlý inkoust, snadno sklouzne k tomu, že chybějící části textu domyslí z okolního kontextu. Výsledkem pak bývá uhlazený, na první pohled věrohodný, ale z genealogického hlediska nepřesný přepis.
Do zadání nevkládejte údaje o žijících lidech bez jejich souhlasu. Ochrana osobních údajů platí i při práci s moderními nástroji a pro genealogický výzkum to znamená pracovat v jazykových modelech výhradně s historickými záznamy a údaji zemřelých předků.
Aby vám umělá inteligence při bádání skutečně pomáhala, musíte jí nastavit pevné mantinely. Model potřebuje přesně vědět, co má dělat s nečitelnými pasážemi, jak naložit se zkratkami a kde končí doslovný přepis a začíná komentář. Pravidla v zadání riziko domýšlení jen snižují; výsledek se vždy ověřuje v prameni. Podrobnější rozbor toho, proč je přesnost důležitější než rychlost, najdete v článku o tom, jak se ptát při luštění písma.
Připravili jsme pro vás pět hotových zadání pro nejčastější situace, se kterými se při bádání v matrikách setkáte. Každé zadání nastavuje modelu jasná pravidla a vede ho k tomu, aby pochybná místa nezakrýval. Můžete je rovnou zkopírovat, vložit do svého nástroje a doplnit vlastní data nebo přiložit snímek z matriky.
1. Přepis matričního zápisu ze snímku
Toto zadání se hodí ve chvíli, kdy máte před sebou snímek matriční strany nebo výřez jednoho záznamu a potřebujete získat věrný přepis původního textu. Společná pravidla pro model jsou v samostatném článku Návod pro model, který čte matriku, na ten doporučujeme odkázat; zde uvádíme jen to, co je pro přepis ze snímku navíc.
Jsi odborný paleograf a archivář. Přepiš text z přiloženého snímku matričního zápisu přesně řádek po řádku tak, jak je zapsán v originále.
Zachovej původní pravopis, interpunkci i řádkování. Nedomýšlej chybějící slova, písmena ani koncovky, které na snímku nejsou zřetelně vidět.
Pokud je některé slovo nebo písmeno nečitelné či poškozené, nahraď ho značkou [nečitelné].
Pokud si nejsi jistý čtením konkrétního slova, uveď svůj nejlepší odhad do hranatých závorek s otazníkem, například [Jan?].
Po doslovném přepisu udělej oddělovač a teprve pod něj vlož stručné vysvětlení sporných míst. Důležité tvary písmen popiš slovy v tomto komentáři.
Nevytvářej žádný souvislý příběh ani modernizovaný text.
Hlavní práci v tomto zadání odvádí striktní požadavek na rozdělení výstupu na doslovný řádkový přepis a oddělený komentář. Prostý text nedokáže zachovat historické tvary písmen, proto zadání požaduje zachování pravopisu, interpunkce a řádkování, zatímco sporné či typické tvary liter má model popsat slovy v komentáři pod oddělovačem.
Důsledné používání značek pro nejistotu vám umožní rychle identifikovat místa, která vyžadují vaši osobní kontrolu přímo v digitálním archivu. Pokud plánujete zpracovávat větší množství zápisů najednou nebo automatizovat svůj badatelský postup, můžete využít pokročilejší postupy popsané v článku o tom, jak postupovat, až vám přestane stačit chat.
Jak poznat špatnou odpověď: Pokud přepis neobsahuje žádné značky nejistoty, nemusí to znamenat chybu, protože u dobře čitelného zápisu může být přepis bez jediné nejistoty správně. Chybějící značky nejistoty jsou však důvod pečlivě porovnat přepis se snímkem a zkontrolovat, zda model nepřehlédl poškozená místa. Varovným signálem je modernizovaný slovosled, svévolně doplněná chybějící jména na poškozeném okraji stránky nebo rozepsané zkratky přímo v hlavním textu bez vysvětlení v poznámce. Stejně tak zpozorněte, pokud model převedl římské číslice na arabské nebo změnil pořadí slov.
2. Překlad a rozbor cizojazyčného zápisu
Toto zadání využijete, pokud už máte přepsaný historický matriční zápis a potřebujete porozumět jeho přesnému významu včetně dobových právních a církevních obratů.
Analyzuj následující přepis historického matričního zápisu.
Text zápisu: "[Zde vložte přepis zápisu]"
Nejprve urči jazyk zápisu a stručně uveď, podle jakých slov či znaků jsi jej určil.
Uveď původní text rozdělený na jednotlivé logické fráze a vedle každé z nich uveď její doslovný český překlad.
Vypiš všechny nalezené zkratky a vysvětli jejich význam; jejich celý nerozkrácený tvar v původním jazyce uveď pouze tehdy, lze-li jej bezpečně doložit, jinak uveď, že to nelze určit.
U sporných nebo víceznačných slov uveď různé varianty překladu pouze tam, kde je text a dobový kontext skutečně podpírají; jinak uveď, že význam nelze jednoznačně určit.
Pro nečitelná místa použij značku [nečitelné] a pro nejistá čtení tvar [slovo?].
Je přísně zakázáno vymýšlet si chybějící údaje, vynechávat nejasné pasáže nebo překládat volnou parafrází.
Síla tohoto zadání spočívá v tom, že nepředjímá jazyk zápisu. Model musí jazyk nejprve sám určit a uvést, podle čeho tak učinil. V matrikách se často mísí latinské formulace s německými či českými jmény a místopisem, což vyžaduje pružný přístup a zabraňuje chybám z nesprávného očekávání.
Paralelní zobrazení původního znění vedle doslovného překladu a rozbor zkratek pomáhají porozumět dobovému kontextu. Tím, že model uvádí varianty výkladu pouze tam, kde mají oporu v textu, se vyhnete uměle vytvořeným dohadům. Zákaz volné parafráze vás chrání před ztrátou důležitých právních nuancí, jako je rozdíl mezi podruhem, domkářem a chalupníkem.
Jak poznat špatnou odpověď: Špatná odpověď se pozná podle toho, že vám model předloží pouze souvislý český text bez uvedení původních výrazů. Jestliže model nerozepsal zkratky a rovnou je přeskočil nebo z nich vytvořil smyšlené slovo, text nepochopil a pouze hádal. Podezřelá je také situace, kdy model určí jazyk chybně nebo nedoloží, ze kterých slov při určení vycházel. Pokud model přeloží odborný historický termín moderním slovem, které zkresluje rodinnou vazbu, výstup nelze použít.
3. Převod rodopisných poznámek do tabulky
Toto zadání použijte ve chvíli, kdy máte v neuspořádaných textových poznámkách zapsané různé údaje o jedné rodině a chcete z nich vytvořit přehledný a strukturovaný systém.
Převeď následující nestrukturované badatelské poznámky do přehledné tabulky.
Text poznámek k převodu: "[Zde vložte své poznámky]"
Vytvoř tabulku s přesně těmito sloupci: Osoba, Událost, Datum, Místo, Jistota, Odkud to vím.
V žádném případě nesmíš vynechat ani zmírnit vyjádřenou nejistotu v poznámkách.
Nečitelná místa označ jako [nečitelné] a nejisté údaje jako [slovo?].
Pokud je datum odhadnuté, přibližné nebo sporné, zapiš ho s otazníkem a ve sloupci Jistota uveď přesný důvod pochybnosti.
Pokud u některé události chybí místo nebo přesný den, ponech v příslušné buňce pomlčku - a nehledej náhradní řešení.
Je přísně zakázáno domýšlet chybějící údaje nebo doplňovat farnosti a letopočty, které v textu přímo nezazněly.
Pokud z jedné poznámky vyplývá více samostatných událostí, vytvoř pro každou z nich samostatný řádek.
Klíčovým prvkem zadání jsou povinné sloupce pro míru jistoty a původ údaje. Tyto sloupce zabraňují modelu v tom, aby vaše pochybnosti a pracovní hypotézy proměnil v nezpochybnitelná fakta. Zadání zároveň výslovně zakazuje zjednodušování a slučování řádků, takže nepřijdete o žádnou dílčí informaci.
Důsledné rozdělení záznamů na jednotlivé události zajišťuje, že se v jedné buňce nepromíchá narození dítěte se sňatkem rodičů nebo úmrtím prarodiče. Pokud se chcete dozvědět více o tom, jak správně pracovat se strukturou dat, podívejte se na tabulku s původem údajů a osvojte si základní pravidla pro zápis nálezů.
Jak poznat špatnou odpověď: Pokud model vytvoří tabulku, ve které chybí sloupec s pramenem nebo kde se u přibližných údajů objeví přesná data bez označení odhadu, odpověď je nepoužitelná. Další závažnou chybou je, když model sloučí více příbuzných do jedné buňky nebo když si sám domyslí farnost či panství, které v původních poznámkách vůbec nebyly zmíněny. Varováním je také situace, kdy model převede textovou poznámku „asi 1785" na pouhé číslo „1785" bez otazníku a bez vysvětlení ve sloupci s jistotou.
4. Kontrola logických chyb v rodokmenu
Toto zadání se hodí, když jste dokončili sestavování rodinné větve a chcete odhalit skutečné nesrovnalosti v datech narození, sňatků a úmrtí napříč generacemi.
Zkontroluj časovou a logickou návaznost v následujícím rodopisném přehledu.
Seznam osob a událostí: "[Zde vložte data k ověření]"
Hledej výhradně skutečné logické a biologické nemožnosti: dítě starší než rodič, sňatek nebo jiná událost po vlastním úmrtí, úmrtí před vlastním narozením.
Všechny ostatní neobvyklé situace (například dítě narozené před sňatkem rodičů, narození po úmrtí otce nebo nezvyklý věk při svatbě) označ pouze jako otázky k ověření, nikoliv jako chyby.
Pokud počítáš časové rozdíly, počítej pouze z plně doložených dat; u neúplných či přibližných údajů uveď možné rozmezí nebo napiš, že výpočet není možný.
Výstup naformátuj jako seznam konkrétních podezření a otázek k ověření, nikoliv jako konečné rozsudky.
Je zakázáno domýšlet vlastní vysvětlení, doplňovat chybějící generace nebo se pokoušet data samostatně opravovat.
Pokud žádný rozpor nenajdeš, výslovně uveď, že v zadaném rozsahu data logicky navazují, ale označ případné neověřené mezery.
Při kontrole rodokmenu je nutné rozlišovat mezi skutečnou nemožností a historickou realitou. Dítě narozené před sňatkem rodičů nebo narození potomka po úmrtí otce nejsou logické rozpory, ale běžné historické situace, se kterými se v matrikách běžně setkáváme. Zadání proto striktně omezuje kategorii chyb pouze na skutečné nemožnosti a ostatní jevy řadí mezi náměty k dalšímu ověření.
Stejně důležitý je střízlivý přístup k výpočtům. Pokud u některé osoby znáte pouze přibližný rok narození odvozený z věku při úmrtí, nelze z něj vyvozovat absolutně přesné časové odstupy. Model proto musí pracovat s rozmezím nebo otevřeně uvést, že přesný výpočet není z dodaných podkladů možný.
Jak poznat špatnou odpověď: Pokud vám model začne sám od sebe přepisovat letopočty s tvrzením, že pisatel udělal chybu a že syn se určitě narodil v jiném roce, jedná se o zásadní selhání. Stejně tak je špatně, když model označí běžnou historickou situaci, jako je narození dítěte před svatbou rodičů, za fatální logický rozpor. Pozor si dejte i na situaci, kdy model počítá přesné věkové rozdíly z přibližných letopočtů nebo tvrdí, že jde o dvě různé osoby stejného jména, aniž by k tomu měl v datech oporu.
5. Porovnání dvou různých čtení
Toto zadání uplatníte ve chvíli, kdy máte k dispozici dva různé přepisy téhož zápisu a potřebujete přesně vidět, v čem se obě textové varianty rozcházejí.
Porovnej následující dvě odlišná čtení téhož historického matričního zápisu.
První verze čtení: "[Zde vložte první verzi]"
Druhá verze čtení: "[Zde vložte druhou verzi]"
Vytvoř přehledné srovnání řádek po řádku a vypiš všechna konkrétní místa a slova, ve kterých se obě verze liší.
U každého rozdílu vysvětli, jaký věcný a genealogický dopad má první i druhá varianta na určení příbuzenských vztahů.
Za žádných okolností nerozhoduj o tom, které čtení je správné, a nedomýšlej třetí variantu jako kompromis.
Výklad konkrétních tvarů písmen uveď pouze v případě, že k zadání přiložím snímek originálu; ze samotného textu tvary tahů neodvozuj.
Pro nečitelná místa používej značku [nečitelné] a pro nejistá čtení [slovo?].
Hlavním těžištěm zadání je přísný zákaz volby vítězného čtení a zákaz vytváření kompromisních variant. Model dostává pouze dva textové přepisy bez snímku, takže nemůže posoudit, které tahy perem rozdíl způsobily. Proto zadání podmiňuje výklad tvarů písmen dodáním obrázku.
Model má sloužit jako nestranný analytik, který pouze pojmenuje odlišnosti v textu a vysvětlí jejich dopad na interpretaci rodokmenu. Tím získáte jasný přehled o sporných místech, na která se musíte sami znovu podívat v archivu. Nezapomínejte, že ani tři čtení jednoho písaře nemusí přinést shodu, pokud se obě varianty opírají o odlišnou interpretaci nejasných tahů.
Jak poznat špatnou odpověď: Špatnou odpověď poznáte okamžitě podle toho, že model jedno ze čtení sebevědomě označí za správné, aniž by měl k dispozici originální snímek. Dalším varovným znakem je, když model bez obrazového podkladu začne popisovat tvary písmen a kliček, nebo ignoruje drobné rozdíly v příjmeních, křestních jménech či číslech popisných. Pokud vám model nabídne nově vymyšlenou třetí verzi zápisu, která v zadání vůbec nebyla, přestal pracovat jako analytik a začal fabulovat.
Jak se zadáními dále pracovat
Tato předpřipravená zadání představují pevný základ, který můžete snadno přizpůsobit svým konkrétním badatelským potřebám. Vždy mějte na paměti, že jazykový model je pouze nástroj pro mechanické srovnávání a třídění textu, nikoliv náhrada za pečlivou práci s prameny v archivu. Pravidla v zadání riziko domýšlení jen snižují; výsledek se vždy ověřuje v prameni. Každý výstup, který od modelu obdržíte, je nutné vnímat jako pracovní hypotézu a osobně ho porovnat s originálním zápisem.
Při úpravě těchto šablon pro další použití se držte několika osvědčených pravidel:
- Vždy v zadání ponechte větu, která výslovně zakazuje domýšlení chybějícího textu.
- Jednotně používejte značení nejistoty se značkami [nečitelné] pro nečitelná místa a [slovo?] pro nejisté čtení.
- Požadujte důsledné oddělení doslovného přepisu od vysvětlujících komentářů.
- Nikdy po modelu nechtějte, aby vynášel konečné soudy o historické pravdě bez doložených podkladů.
- Do zadání nevkládejte údaje o žijících lidech bez jejich souhlasu.
Když budete tato pravidla dodržovat, usnadníte si práci při přepisu i rozboru pramenů. Získáte dobré vodítko pro své bádání a vyhnete se chybám, které by vás mohly zavést do slepých uliček.