Geri Dön
SiTech Team⏱️ 1 წთ. საკითხავი

GPT ve Claude Neden Bridgewater'ın Finans Testlerinde Başarısız Oldu — Doğru Yanıtlar Hiçbir Zaman Kamuya Açık Değildi

GPT ve Claude Neden Bridgewater'ın Finans Testlerinde Başarısız Oldu — Doğru Yanıtlar Hiçbir Zaman Kamuya Açık Değildi

Bridgewater Associates ve Thinking Machines Lab, GPT ve Claude'un finansal belge analizinde yalnızca ~%50 doğruluk elde ettiğini kanıtladı — çünkü doğru yanıtlar hiçbir zaman kamuya açık eğitim verilerinde yer almamıştı.

💰 GPT ve Claude'un Başarısız Olduğu Test — Finansal Belgelerde %50 Doğruluk

Bugünün rekabetçi AI dünyasında, büyük dil modellerinin (LLM'ler) programlamadan matematiğe ve hukuka kadar karmaşık sorunları nasıl çözdüğünü her gün duyuyoruz. Ancak GPT-4.1 ve Claude, Bridgewater Associates'in özel finansal veritabanlarıyla karşılaştığında sonuç şaşırtıcıydı. Her iki model de yalnızca yaklaşık %50 doğru yanıt verdi — bu, doğru analizden çok rastgele tahmine yakın bir seviye.

Dünyanın en güçlü iki modeli neden bu belirli görevde başarısız oldu? Cevap basit ve şaşırtıcı: çünkü doğru cevaplar hiçbir zaman kamuya açık eğitim verilerinde yer almamıştı.

📖 The Decoder'da tam makaleyi okuyun