[Csaladtortenet 2] AI
George Gaál
gb12335 at gmail.com
2026. Okt. 4., V, 11:22:12 CEST
Kedves Péter!
Nagyon köszönöm, hogy megosztottad a tapasztalataidat. Szeretném én is
megosztani néhány gondolatomat.
Informatikai területen dolgozom, ezért napi szinten találkozom
AI-megoldásokkal és azok eredményeivel. A véleményem természetesen nem
szakértői vélemény, de azért nem is egy olyan ember véleménye, aki tegnap
találkozott először a Geminivel. :-)
Az anyakönyvek felismerésével kapcsolatban szerintem alapvetően két
lehetőség van. Használhatunk erre specializált megoldásokat, például a
Transkribus <https://www.transkribus.org/> vagy a Regestum
<https://regestum.ro/> szolgáltatását.
Az elsőt kipróbáltam, és az eredmény finoman szólva sem volt kielégítő.
Ráadásul az árazási modellje sem teljesen világos számomra. A második már
ígéretesebbnek tűnik, de véleményem szerint a jelenlegi 0,108 euró/oldal
meglehetősen drága, és a felismerés sem tökéletes, még akkor sem, ha
ígérik, hogy figyelembe veszik a magyar nyelvű anyagok sajátosságait.
Én személy szerint egy fizetős Claude-előfizetést használok, ami körülbelül
200 dollárba kerül. A Claude Agent mechanizmusán keresztül használom. Ez
lényegében egy helyben, a saját számítógépeden futó agent. Ennek az a nagy
előnye, hogy a folyamatot különböző külső segédprogramok futtatásával is
tudja optimalizálni: például feldarabolhatja vagy levághatja a fájlokat,
újrapróbálkozhat, és összességében nagyon hatékonyan tudja elvégezni a
kézírásos bejegyzések átírását.
Ez szerintem nagy különbség egy hagyományos online chathez képest, ahol fel
kell tölteni az adatokat, beleütközöl a feltöltési korlátokba stb.
Az sem mellékes, hogy milyen modellt használunk. Az egyes modellek
felismerési képességei között meglehetősen nagy különbség lehet.
Az Anthropic Claude jelenleg több modellt kínál – Haiku, Sonnet, Opus és
Fable –, nagyjából a kevésbé erősektől a fejlettebbek felé haladva.
Számomra az Opus bizonyult a legjobb kompromisszumnak. A Fable is jól
működik, de ehhez a feladathoz szerintem túlzás: ugyanazért a minőségért
egyszerűen körülbelül kétszer olyan gyorsan fogyasztja a keretet.
A Sonnet és a Haiku sajnos nagyobb léptékben nem teljesít túl jól a
kézírásos szöveg felismerésében. Gyors és olcsó előzetes feltérképezésre
viszont jó választás lehetnek.
A technológia folyamatosan változik, ezért a vezető szerep is ide-oda
vándorol az Anthropic és az OpenAI (ChatGPT) között. Elképzelhető, hogy
helyben futó modellekkel, például Qwen vagy Gemma modellekkel is jó
eredményt lehetne elérni, de valószínűleg ezeket valamilyen szinten
finomhangolni kellene, ami – amennyire én értem – egy átlagos felhasználó
számára már meglehetősen bonyolult feladat.
Amit Péter példája szerintem nagyon jól megmutat, az az, hogy nem
feltétlenül csak a teljes anyakönyvek automatikus átírásában van nagy
lehetőség. Ugyanilyen fontos lehet a célzott keresés is: megadunk néhány
nevet, egy települést vagy egyéb szempontot, és az AI végignézi akár több
száz oldalon, hogy hol talál releváns bejegyzéseket. Erre emberi erővel
sokszor egyszerűen nincs idő.
Én ezért az AI-t elsősorban nem végső forrásként, hanem egy nagyon hatékony
első feldolgozási rétegként kezelném. A gép elvégzi a hatalmas mennyiségű
mechanikus munkát, utána pedig az ember ellenőrzi a bizonytalan vagy fontos
találatokat. Ha ezt a kettőt jól kombináljuk, szerintem sokkal jobb
eredményt lehet elérni, mint ha vagy mindent kézzel csinálunk, vagy vakon
megbízunk az AI által adott eredményben.
És szerintem az is fontos, hogy ne egyszerűen „OCR-szöveget” állítsunk elő,
hanem lehetőleg strukturált adatot is: dátum, név, esemény típusa, szülők,
házastárs, lakhely stb. Így az egyszer feldolgozott anyag később nemcsak
olvasható lesz, hanem ténylegesen kereshető és újra felhasználható
adatbázissá válhat.
Egy dolgot viszont különösen fontosnak tartok: szerintem önmagában nincs
sok értelme annak, hogy egyszerűen csak „felderítsük” az anyakönyvi
képeket, majd mindenki külön-külön újra végignézze ugyanazokat a
tekercseket. Sokkal több értelme van annak, hogy amit egyszer már megnézett
és átírt valaki, annak az eredményét megosszuk egymással.
Ha ezt többen is csinálnánk, szerintem érdemes lenne valamilyen egységes
formátumot is kialakítani az eredményekhez. Például minden feldolgozott
oldalhoz vagy bejegyzéshez ugyanazokat az alapadatokat rögzíteni: dátum,
név, esemény típusa, szülők, házastárs, lakhely, forrás és oldalszám.
Így nemcsak az történne, hogy valaki gyorsabban megtalálja a saját ősét,
hanem minden egyes feldolgozott oldal hozzáadódna egy közös, kereshető
adatvagyonhoz. Ha tíz vagy akár száz kutató különböző anyakönyveken
dolgozik, ennek idővel nagyon komoly értéke lehet.
Szerintem ez az a pont, ahol az AI igazán megváltoztathatja a genealógiai
kutatás logikáját: nem ugyanazt a munkát végezzük el újra és újra
külön-külön, hanem minden elvégzett munka hozzáad valamit a közös
eredményhez.
Összességében, TL;DR: jelenleg a Claude körülbelül 30%-kal olcsóbban tudja
elvégezni ugyanezt, mint a Regestum. Ha pedig kihasználjuk a fejlettebb
lehetőségeket és automatizáljuk a munkafolyamatot, akkor még a SaaS-alapú
modelleknél is jelentősen lejjebb lehet szorítani az egy oldalra jutó
költséget.
Üdv,
György
További információk a(z) csaladtortenet levelezőlistáról