Jak si ověřit, že vám AI nelže
Jak zacházet s přepisem matriky od AI jako s pracovní hypotézou a ověřit jej přímo na snímku a v dalších pramenech.
6 minut čtení
Proč potřebujete kontrolní seznam
Když začínáte sestavovat rodokmen a otevřete digitální archiv, staré matriky mohou působit jako neproniknutelná hradba. Novogotické písmo, latinské formulace a vybledlý inkoust představují překážku, kterou se dnes mnoho badatelů snaží překonat pomocí umělé inteligence. Možnost nahrát výstřižek starého záznamu do chatu a obratem získat přepsaný text vypadá jako obrovská pomoc.
Jazykové modely však nepracují jako neomylní badatelé. Jejich základním principem je vytvářet hladce plynoucí a věrohodně znějící texty. Když narazí na poškozený papír, neobvyklou zkratku nebo těžko čitelný tah pera, nemají přirozenou tendenci zastavit se a přiznat neznalost. Místo toho chybějící místo často zaplní tím, co se zdá nejpravděpodobnější podle jazykových pravidel a zadaného kontextu.
V rodopisné praxi nepředstavují největší nebezpečí zjevné nesmysly, které na první pohled odhalíte. Mnohem zrádnější jsou úhledné, gramaticky bezchybné a přesvědčivé odpovědi, ve kterých model tiše zamění jedno jméno za jiné. Pokud takovou chybu přehlédnete, můžete snadno začít zkoumat zcela cizí rodinnou větev.
Nejde o test, jímž by se dala AI prohlásit za spolehlivou. Jde o postup, jak oddělit návrh přepisu od údaje, který jste opravdu ověřili.
Co ověřit před zápisem do poznámek
Začněte čtením samotného snímku. AI může nabídnout pracovní přepis, nemůže však převzít odpovědnost za to, co je na stránce skutečně napsáno.
- Neberte plynulý výstup jako důkaz. Plynulá věta může vzniknout i z nejistě přečtených písmen.
- Opakování není nezávislá kontrola. Stejný nástroj nad stejným obrázkem může nabídnout stejný omyl. K této otázce se podrobněji vrací článek Tři čtení, jeden písař.
- Vyzvěte k označení nejistoty. Žádejte, aby sporná místa zůstala jako
[?], ne jako domyšlené jméno.
- Nechte model důsledně oddělit doslovný přepis od výkladu. Požadujte, aby nástroj nejprve vypsal přesné znění textu písmeno po písmenu v dobovém pravopisu a moderní překlad nabídl až ve druhé, oddělené části. Přesné pokyny pro takové zadání shrnuje návod pro model, který čte matriku.
- Ptejte se cíleně na to, co v zápisu není zřetelně vidět. Žádejte model o výčet poškozených míst, sporných liter a alternativních možností čtení. Pokud porovnáváte odhady různých nástrojů podle postupů z článku dvě čtení jedné stránky, zaměřte se právě na slova, ve kterých se jejich návrhy neshodují.
- Všechny údaje kontrolujte proti skenu, nikoli proti vlastní paměti. Každé přečtené jméno, datum i název obce si vždy ověřte přímo pohledem na originální archivní snímek. Lidská paměť snadno podlehne sugesci a přijme nabízené slovo za skutečnost, i když na snímku stojí jiné písmeno.
Jak číst návrh přepisu
Abychom s umělou inteligencí pracovali bezpečně, musíme rozumět mechanismu, kterým své odpovědi skládá. Jazykový model nečte text tak, jak to dělá zkušený badatel, který s lupou v ruce zkoumá směr tahu brku a dobové zvyklosti. Model zpracovává obrazová a textová data a hledá statistické souvislosti mezi tvary a slovy.
Pokud model narazí na nečitelné příjmení, kde je zřetelné pouze první písmeno, pokusí se mezeru doplnit podle toho, jaká slova se v podobných textech obvykle vyskytují. Pokud mu v zadání prozradíte, že v dané vsi hledáte rod N., model velmi ochotně přečte i nejasnou kaňku právě jako hledané příjmení.
Výsledek může být přesvědčivý, i když není opřený o čitelné tahy na snímku. Proto jej berte jako návrh, který má usnadnit další kontrolu.
Proto je nutné k výstupům přistupovat nikoli jako k hotovým faktům, ale výhradně jako k pracovním hypotézám. Model vám může ušetřit mnoho času při orientaci v textu, ale závěrečné posouzení musí vždy provést člověk.
Jak správně připravit zadání pro model
Správný postup začíná už při přípravě podkladů. Nikdy nevkládejte do chatu pouze jedno izolované slovo vytržené ze souvislosti. Model potřebuje vidět okolní řádky, aby mohl porovnat, jak daný písař píše jednotlivá písmena v jiných, dobře čitelných slovech.
Při zadávání dotazu postupujte podle následujících kroků:
- Otevřete nové, čisté okno rozhovoru. Pokud v konverzaci pokračujete po dlouhém bádání, model si pamatuje předchozí zmínky a může jimi nevědomky zkreslit nové čtení.
- Neprozrazujte svá očekávání. Nikdy se neptejte stylem: „Je na tomto řádku zapsán Jan N. ze vsi A.?" Místo toho zadejte neutrální pokyn: „Přepiš text na vyznačeném řádku písmeno po písmenu a zachovej dobový pravopis."
- Vyžadujte označování nejistot. Výslovně modelu uložte, aby každé pochybné písmeno označil otazníkem a zcela nečitelné části slovem v závorce. Tím model přinutíte, aby se vyhnul tichému doplňování chybějícího textu.
- Oddělte doslovný přepis od překladu. Přepis musí zůstat v přesném dobovém jazyce, ať už jde o starou češtinu, němčinu nebo latinu. Teprve pod přepisem si nechte vysvětlit význam archaických slov nebo úředních formulí.
Práce se spornými místy a variantami
Když při čtení narazíte na sporné slovo, nespokojte se s jednoduchým opakováním dotazu ve stejném okně. Pokud máte pochybnosti o příjmení nebo názvu vsi, vyzkoušejte několik nezávislých kroků.
Nejprve porovnejte sporné písmeno s jinými slovy na stejné stránce, o jejichž čtení není pochyb. Pokud váháte, zda písař napsal začáteční písmeno jako jedno nebo druhé, najděte na stránce běžné křestní jméno začínající na stejné písmeno. Tvar křestního jména vám poslouží jako bezpečné měřítko pro sporné příjmení.
Dále můžete tentýž výstřižek předložit dvěma odlišným nástrojům v samostatných oknech bez nápovědy. Pokud se oba nástroje v přepisu rozejdou, získáváte velmi cennou informaci: místo je skutečně nejednoznačné a vyžaduje vaši osobní pozornost.
Pokud se naopak oba nástroje shodnou, pamatujte, že ani dvojí shoda není definitivním důkazem. Znamená to pouze, že oba systémy vyhodnotily předložený obrázek stejným způsobem. Konečné slovo musí vždy patřit srovnání s dalšími prameny, například se záznamy o narození sourozenců, s oddacími zápisy nebo s pozemkovými knihami.
Co zapsat do rodokmenu a co nechat otevřené
Poctivá genealogická práce se pozná podle toho, jak badatel zachází s nejistotou. Začátečníci mívají tendenci zapsat do rodokmenu každé jméno jako hotovou věc, aby v rodinném stromu nezůstávala prázdná místa. Tento přístup však vede k tomu, že se drobné omyly vrství na sebe a po několika generacích se celý výzkum zhroutí.
Když dokončíte kontrolu záznamu, zapište si výsledek podle těchto pravidel:
- Zaznamenejte všechny zvažované varianty. Pokud bylo čtení příjmení nejednoznačné, poznamenejte si do poznámek obě možné podoby, například Jan N. i Jan M. ze vsi A.
- Uveďte důvod svého rozhodnutí. Do badatelského deníku si stručně napište, proč jste se přiklonili k jedné z variant. Můžete uvést, že tvar písmene odpovídá jiným zápisům téhož písaře nebo že se stejná podoba objevuje u kmotrů dalších dětí.
- Připojte přesnou archivní citaci. Každý záznam musí obsahovat odkaz na archiv, fond, číslo matriční knihy a číslo snímku. Bez přesného odkazu se ke spornému místu v budoucnu už nevrátíte.
- Nebojte se nechat položku neuzavřenou. Otazník v rodokmenu je mnohem cennější než chybně zapsaný předek. Přiznaná nejistota vás při další návštěvě archivu upozorní, na jaké souvislosti se máte zaměřit.
Shrnutí pro každodenní badatelskou praxi
Výstup AI si ukládejte jako návrh, nikoli jako hotový údaj. U rozhodujícího jména, data nebo příbuzenského vztahu si poznamenejte, co je vidět na snímku, co jste ověřili v dalším prameni a co zůstává otevřené.
Kontrola nemusí skončit rozhodnutím. Pokud snímek ani další pramen nejistotu nevyřeší, nechte ji v poznámce. Takový zápis se dá později znovu prověřit bez toho, aby se z domněnky stal zdánlivý fakt.