
Yapay zekâ destekli soyağacı: bir geliştiricinin deneyimi
Bir geliştiricinin yapay zekâ asistanlarıyla soyağacını çıkarma deneyiminin devamı: resmî kayıtlarla doğrulama, arşiv otomasyonu ve tek dalda 13 kuşağa uzanan 1200'den fazla ata.
Ailesinin soyağacını yapay zekâ asistanlarının yardımıyla kuran bir geliştirici, önceki yazısının devamını yayımlayarak eksik kalan pratik ayrıntıları ekledi. A Java Geek blogundaki yeni raporda, asistanın aramalarını resmî kayıtlara nasıl dayandırdığını, gelenek ve arşiv sitelerinde gezinmeyi nasıl otomatikleştirdiğini ve yüzyıllık el yazılarını özel araçlarla okuma denemelerinden ne öğrendiğini anlatıyor.
Güven, ama doğrula
İlk ders halüsinasyonla ilgili. Yazar, asistanın yanıt uydurabileceğini kabul ediyor; ancak bu itirazın, yanıt gerçek verilere dayandığında büyük ölçüde geçerliliğini yitirdiğini savunuyor. Soy sitelerinin kendisi ise tamamen güvenilir kaynaklar değil. Soy verileri için standart biçim olan GEDCOM, QUAY adlı bir kalite alanı tanımlıyor: 0 güvenilmez veya tahmini veri, 1 şüpheli güvenilirlik (söyleşiler, sözlü aktarımlar), 2 olaydan sonra kaydedilmiş ikincil kanıt, 3 ise doğrudan ve birincil kanıt anlamına geliyor.
Buradan çıkan kuralı şöyle: Soy sitelerinden toplanan veriler QUAY 2 ile başlıyor; bir nüfus veya kilise kaydı bunu doğrularsa kayıt QUAY 3'e yükseltiliyor, doğrulamıyorsa atılıyor.
Arşivlerde ve oturumlarda otomasyon
Arşiv siteleri iki eksende farklılaşıyor: açık erişim ya da hesap zorunluluğu ve bot engellemenin sertliği. En zayıf koruma curl ile okunabiliyor; orta seviye, yazarın Playwright ile yönettiği tam bir tarayıcı gerektiriyor; en sıkı korunan siteler Cloudflare benzeri savunmaların arkasında duruyor ve orada Chrome'u hata ayıklama modunda başlatıyor. Bu son yöntem kırılgan, çünkü tarayıcının kapanması çalışmayı bitiriyor. Bu yüzden çoğu sitede kalıcı oturum profilli Playwright'ı tercih ediyor: bir kez giriş yap, tarayıcıyı kapat, sonra asistan aynı erişimle çalışsın. Kişisel bilgileri asistana vermenin akıllıca olmadığını da ekliyor.
Yazı çözümü denemeleri
Kayıtların yazıya dökülmesi önemli; zorluk kâtibin el yazısına, dil bilgisine ve belgenin yaşına bağlı. Asistan titiz davranıp tahmin yerine yer tutucu koymayı seçti. Diğer araçlar daha kötü sonuç verdi: Transkribus anlamsız metin döndürdü ve yazarın sonradan okuduğuna göre kullanıcının kendi belgeleriyle eğitilmesi gerekiyor; kraken tabanlı yerel kurulum Transkribus'u geçti ama asistandan çok geride kaldı; Fransız soy sitesi Filae ise Fransız el yazısında mükemmel sonuçlar verdi, ne var ki hizmet kapatılmış görünüyor.
Sonuç
Rapor bir döngüyü de anlatıyor: resmî kayıtlarda bulunan atalar onu yeniden soy sitelerine gönderiyor; oradaki akıllı eşleşme sezgileri başkalarının ağaçlarında zaten yer alan kişileri ortaya çıkarabiliyor. Eşleşmelere temkinli yaklaşıyor, çünkü tek bir yanlış onay bütün bir dalı bozabiliyor; yine de bu yolla gözden kaçan yazım varyantları da bulunabiliyor. Proje şu anda 1200'den fazla kişiyi ve tek bir dalda 13 kuşağı kapsıyor.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.