
170 bin İngilizce kelimeyi ölçtüğünü iddia eden test yöntemi tartışıldı
Yaklaşık 170 bin İngilizce kelimeden kaçını bildiğinizi tahmin eden bir web uygulaması Hacker News'te 501 puan ve 555 yorum topladı; kullanıcılar örnekleme yöntemini, kelime kuşaklarını ve tempoyu eleştirdi.
Google Cloud Run üzerinde barındırılan bir web uygulaması basit bir soru soruyor — İngilizcedeki yaklaşık 170 bin kelimeden kaçını biliyorsunuz? — ve bunu tek bir sayıyla biten 100 soruluk çoktan seçmeli bir testle yanıtlıyor. Hacker News'teki paylaşım 501 puan ve 555 yorum aldı; tartışmanın büyük bölümü sayının kendisinden çok nasıl hesaplandığına odaklandı.
Testin kendi anlatımına göre nasıl çalıştığı
Yorumculardan alıntılanan "Bu nasıl hesaplanıyor" sayfası, Oxford English Dictionary'nin (ikinci baskı) güncel kullanımda yaklaşık 171.476 kelime listelediğini belirtiyor. Araç, rastgele kelimeler yerine tabakalı örnekleme kullandığını ve dili kullanım sıklığına göre beş zorluk kuşağına ayırdığını söylüyor: Temel (~3.000 kelime), Orta (~7.000), İleri (~10.000), Uzman (~25.000) ve "Muğlak" (40.000+). Tahmin, her kuşaktaki doğruluk oranının o kuşağın büyüklüğüyle çarpımının toplamı.
Bu aritmetik hemen dikkat çekti: kuşakların toplamı 170.000 değil yaklaşık 85.000 kelime ediyor; yani tüm soruları doğru yanıtlayan bir kullanıcı bile dilin kabaca yarısına denk gelen bir "bilimsel tahmin" elde ediyor. Birkaç yorumcu tam olarak bunu bildirdi: kusursuz tur sonunda 85.000 kelime.
Kelimelere ve tanımlara yönelen itirazlar
Kullanıcılar tek tek kelimelerin sınıflandırılmasına itiraz etti. Bir yorumcuya göre "breviary" orta düzey olarak etiketlenmişti ve bu, pek çok okurun hiç görmediği bir kelime için fazla kolay bir yer; diğerleri ise kelimenin Katolikler ve Orta Çağ el yazmalarını okuyanlar için tanıdık olduğunu savundu. "Metamorphosis" ve "kinetic" uzman düzeyinde gösterildi, bunu bazıları inandırıcı bulmadı. "Hippopotomonstrosesquippedaliophobia" ise gösteri kelimesi olarak nitelendi — bir okurun deyişiyle, parçalarından tanınabildiği için kelime bilgisinden çok bilgi yarışması sorusu gibi.
Bazı tanımlar da gevşek bulundu; örneğin "lethargy" için "uyuşukluk hâli" denmesi. Çoktan seçmeli biçim tahmini kolaylaştırıyordu: yorumcular en uzun seçeneğin sıklıkla doğru olduğunu ve çeldiricilerin çoğu zaman "doğru anlam, zıt anlam ve ilgisiz iki şey" kalıbını izlediğini belirtti.
Tempo, yanlılık ve kullanıcı talepleri
En yaygın şikâyet mekanikti: bir tıklamanın yeteceği yerde kelime başına üç tıklama ve baştan sona 100 kelime. Bazıları erken bıraktı. Bir yorumcu testin neredeyse hiç uyarlanabilir olmadığını savunurken, bazıları herkese aynı kelime listesinin gösterildiğini tahmin etti; ancak farklı kelimeler görenler de oldu. Öneriler arasında çok daha büyük bir kelime kümesini test edip her kullanıcı için soru örneklemek, tahmini her yanıttan sonra güncellemek, "bilmiyorum" düğmesi eklemek ve yanlış yanıtların özetini göstermek vardı.
Başlıkta paylaşılan sonuçlar yaklaşık 61.000 ile 85.000 kelime arasında değişti. Uygulamanın verdiği sayıyı 1970 baskısı Shorter Oxford English Dictionary'den rastgele bir örnekle karşılaştıran bir yorumcu, rakamın şişirilmiş olduğu sonucuna vardı; bir başkası ise kelime listesinin Latince ve Yunanca köklere ağır biçimde yöneldiğini, bunun da bu dillerin konuşurlarına avantaj sağladığını savundu.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.