Přeskočit na obsah
Naše paměť

Dvě čtení jedné stránky

Jak ověřovat čtení starých zápisů pomocí dvou nezávislých služeb umělé inteligence a proč ani plná shoda neznamená hotový důkaz.

8 minut čtení

Proč u sporného místa jedno čtení nestačí

Při luštění starých rukopisů bývá lákavé spolehnout se na první odpověď, kterou od jazykového modelu dostanete. Pokud je zápis dobře čitelný, písmo zřetelné a textu sami bez potíží rozumíte, jedno běžné přečtení nebo prostá vlastní kontrola obvykle stačí. V takovém případě není nutné postup komplikovat dalším ověřováním.

Jiná situace nastává u sporných slov, neobvyklých příjmení nebo poškozených řádků. Umělá inteligence může působit velmi jistě i ve chvílích, kdy si textem jistá není. Pokud je některé písmeno poškozené nebo nečitelné, model si chybějící části domyslí podle nejpravděpodobnějšího jazykového vzoru. Na takový odhad nemusí nejistotu přiznat a nabídne vám zdánlivě hotové slovo.

Tato vlastnost může badatele svést na nesprávnou stopu. V článku Tři shodná čtení nejsou tři důkazy jsme si ukázali, proč nemá smysl žádat tutéž službu o opakované potvrzení vlastního výstupu v jedné konverzaci. Model má sklon držet se své předchozí volby a dřívější odpověď může jeho další čtení ovlivnit. Pokud se ptáte stále dokola v jednom okně, nezískáváte nový pohled, ale jen ozvěnu téhož odhadu.

Když narazíte na zápis, kde záleží na každém písmenu příjmení nebo názvu vsi, vyplatí se získat druhý pohled. Podobně jako v badatelně požádáte o radu kolegu, můžete tentýž výřez předložit dvěma odlišným službám. Získáte tím srovnání pro odhalení skrytých úskalí zápisu. Základní postup pro práci s jedním nástrojem popisuje článek Čtení matrik s obyčejným chatem, zde se zaměříme na souběžnou práci se dvěma nástroji.

Postup pro dvě různé služby

Příprava začíná správným ořezem snímku z archivu. Z matriční stránky vyřízněte sporné slovo a přidejte k němu několik okolních řádků, aby model viděl styl písaře. Tento jeden obrázek uložte do počítače. Pro základní srovnání použijete tentýž nezměněný výřez pro obě zkoušky, protože jakýkoli rozdíl v obrázku by mohl změnit podmínky a výsledky by nebyly porovnatelné.

Následně otevřete dvě různé služby v samostatných oknech prohlížeče. Do obou vložte stejný výřez a zadejte shodný text dotazu. Požádejte například o doslovný přepis vyznačeného řádku do moderní latinky a o zachování původních tvarů bez doplňování chybějících hlásek. Formulaci dotazu ani pořadí instrukcí mezi službami neměňte, abyste udrželi rovné podmínky.

Při zadávání dotazu se vyvarujte dvou častých chyb. Ani jedné službě neprozrazujte svůj vlastní názor, takže se neptejte návodně, zda je na řádku zapsán Jan N. ze vsi A. Stejně tak žádné službě neukazujte, co vám před chvílí odpověděla ta druhá. Pokud hledáte přehled vhodných nástrojů a jejich možností, poslouží vám rozcestník Až přerostete obyčejný chat.

Pokud chcete vyzkoušet, jak na čtení působí jiný výřez nebo širší okolí zápisu, proveďte to až jako samostatnou doplňkovou zkoušku. Takový test může přinést užitečné postřehy k rukopisu, ale neslouží jako přímé srovnání dvou služeb nad stejným zadáním.

Co znamená shoda obou čtení

Pokud vám obě služby vrátí navlas stejný přepis, může to vyvolat dojem, že je záhada vyřešena. Shoda dvou modelů však není důkazem historické skutečnosti. Může se stát, že obě služby pouze zopakovaly stejný omyl kvůli nejasnému tahu pera. Pokud je písmeno v originále objektivně nečitelné, mohou se oba systémy shodnout na nejpravděpodobnějším tvaru, který však písař nezapsal.

Shoda mezi modely představuje užitečný podnět a dobré vodítko pro další ověřování. Neměli byste ji však přijímat jako hotový fakt bez vlastního pohledu do originálního pramene a do souvisejících záznamů. Porovnejte jednotlivá sporná písmena s jinými slovy na téže stránce, kde je význam čitelný a jednoznačný.

Představte si situaci, kdy obě služby přečtou jméno otce jako Jan N. ze vsi A., ale zápis o svatbě téhož člověka v jiné části matriky uvádí jiné jméno. V takové chvíli musíte pracovat s celkovou kritikou pramenů, o které píšeme v článku Když se dva prameny neshodnou. Dvojí shoda modelů nad jedním snímkem nevypovídá o historické pravdě, ale pouze popisuje, co je podle algoritmů na obrázku vidět. Konečné posouzení zůstává na srovnání originálu s dalšími prameny.

Co znamená neshoda ve čtení

Když vám každá služba nabídne jiné čtení, není důvod k nespokojenosti. Neshoda mezi dvěma modely neznamená selhání metody, ale slouží jako upozornění na místo, na které se máte podívat sami. Místo abyste podrobně procházeli celý zápis, vaše pozornost se zaměří na konkrétní sporná písmena.

Rozdílné čtení může znamenat, že je zápis na daném místě skutečně nejednoznačný, ale může jít také o obyčejnou chybu jednoho z modelů. V praxi se často stává, že se služby shodnou na většině věty a rozejdou se pouze v jednom slově. První služba přečte příjmení jako Jan N. ze vsi A., zatímco druhá nabídne tvar Jan M. z téže vsi.

V té chvíli víte, že se máte na sporné místo podívat sami a prozkoumat tvary tahů. V kurentu bývají některá písmena snadno zaměnitelná. Rozdílné odpovědi vás vyzvou k tomu, abyste prozkoumali okolní zápisy téhož písaře a ověřili, jak psal velké N a velké M v jiných slovech na téže straně.

Neshoda vás chrání před ukvapeným zápisem chybného údaje do rodokmenu. Nutí vás zpomalit, nespoléhat se na automatický přepis a prohlédnout si archivní záznam vlastníma očima.

Co je potřeba pro oddělené odhady

Když mluvíme o srovnání dvou čtení, máme na mysli dva odděleně získané odhady. Aby mělo takové srovnání smysl a přineslo užitečné informace, je nutné dodržet několik podmínek, které zabrání vzájemnému ovlivnění výsledků.

V první řadě potřebujete dvě odlišné služby s různým technickým základem. Pokud použijete dvě různá webová rozhraní, která však v pozadí pracují se stejným modelem, získáte v podstatě odpověď téhož systému. Pro oddělené posouzení je nutné volit nástroje od různých provozovatelů.

Druhým požadavkem je čisté okno bez předchozí historie konverzace. Každý dotaz zadávejte do nově otevřeného chatu, aby model nebyl ovlivněn tím, co jste v daném okně řešili před chvílí. Pokud byste vkládali výřez do rozepsané debaty, systém by mohl navazovat na dřívější kontext.

Třetím pravidlem je nepředkládat modelům žádné nápovědy. Jedné ani druhé službě neprozrazujte svůj vlastní názor a neukazujte druhé službě odpověď té první s žádostí o posouzení. Jakmile byste do dotazu vložili přepis z prvního nástroje, druhý model by mohl cizí návrh nekriticky převzít. Oddělené odhady vyžadují, aby obě služby pracovaly samostatně a bez znalosti toho, co navrhuje druhá strana.

Pokud chcete otestovat vliv jiného ořezu nebo jiného nasvícení snímku, proveďte to jako samostatnou doplňkovou zkoušku. Základní srovnání však vždy provádějte nad stejným obrázkem i stejným textem zadání.

Soukromí a práce s podklady

Při práci s online nástroji pamatujte na to, že odesíláte digitální kopie dokumentů na servery externích poskytovatelů. Před nahráním snímku do jakékoli služby je nutné ověřit stáří a obsah daného zápisu, seznámit se s pravidly příslušného archivu a zkontrolovat podmínky samotné služby, které obrázek svěřujete.

Pokud pracujete s novodobými rodinnými písemnostmi, soukromými deníky nebo korespondencí, které se týkají žijících osob, buďte obzvláště opatrní. Zásady bezpečné práce s archivními materiály a ochranu soukromí probíráme podrobněji v článku Čtení matrik s obyčejným chatem. Samotný výstup jazykového modelu není historickým pramenem, ale pouze pomocným pracovním čtením, které je nutné konfrontovat s originálem.

Co si zapsat do rodokmenu

Když dokončíte srovnání obou služeb a sami pramen prozkoumáte, přichází na řadu záznam výsledku. Mnoho badatelů má ve zvyku zapsat do rodokmenu pouze výsledné jméno a na celý proces luštění zapomenout. Tím se však vytrácí důležitá informace o tom, nakolik bylo čtení daného místa jednoznačné.

Pokud bylo čtení sporné, zaznamenejte si do poznámek obě nabízené varianty a uveďte, ke které z nich jste se přiklonili a z jakého důvodu. Uveďte například, že se dané příjmení objevuje ve stejném tvaru u narození dalších dětí nebo že tvar písmene odpovídá jiným slovům na téže stránce.

Nezbytnou součástí každého záznamu musí být přesná citace archivního pramene, včetně názvu archivu, čísla matriční knihy, čísla strany nebo fólie a odkazu na konkrétní digitální snímek. Když se k zápisu po čase vrátíte, budete přesně vědět, jaké podklady jste měli k dispozici a jak jste k danému závěru dospěli.

Otevřené přiznání nejistoty v poznámkách je běžnou součástí poctivé badatelské práce. Rodopisné záznamy, které přiznávají pochybnosti a uvádějí zdroje, poskytují mnohem pevnější základ pro další práci než záznamy, kde jsou sporná místa zapsána bez jakéhokoli vysvětlení.

Kdy se dvojí čtení nevyplatí

Srovnání dvou čtení představuje užitečný postup, ale není potřeba ho uplatňovat při každém setkání s matrikou. U zápisů psaných přehledným písmem, kde jsou všechny litery zřetelné a vy sami jim bez potíží rozumíte, bohatě stačí jedno běžné přečtení nebo vaše vlastní kontrola.

Tento postup má své opodstatnění především u nejasných, poškozených nebo zvláště důležitých míst. Typickým příkladem jsou hustě psané kurentní záznamy, vybledlý inkoust, texty poškozené skvrnami nebo zápisy klíčových předků, kde by chybné čtení mohlo nasměrovat další pátrání nesprávným směrem.

Používejte srovnání dvou služeb uvážlivě jako cílený nástroj pro obtížná a sporná místa. Pomůže vám získat potřebný odstup, upozorní vás na problematické detaily a nasměruje vaši pozornost k důkladné kontrole přímo v archivním originále.

Psali: Vašek Mareš · Ford Prefect · Marvin · Hlubina myšlení

Návod vznikl jako praktický postup pro ověřování sporných slov ve starých matrikách.