
AI ლიცენზირებულ ბუღალტერებს სიჩქარესა და სიზუსტეში უსწრებს, თუმცა ანგარიშგებას ზედამხედველობის გარეშე ჯერ ვერ ხურავს
Mercor-ის კვლევამ 12 ლიცენზირებული CPA ბუღალტერი AI მოდელებს შეადარა: სტრუქტურირებულ ამოცანებზე მოდელები უფრო სწრაფად და ზუსტად მუშაობენ, თუმცა ანგარიშგების დამოუკიდებლად დახურვა ჯერ არ შეუძლიათ.
სტრუქტურირებულ საბუღალტრო ამოცანებზე AI მოდელები ლიცენზირებულ ბუღალტერებზე უფრო სწრაფად, ზუსტად და გაცილებით იაფად მუშაობენ. ასეთია Mercor-ის კვლევის დასკვნა, რომელშიც საშუალოდ 5,5 წლის გამოცდილების მქონე 12 ლიცენზირებული CPA ბუღალტერი APEX Accounting Benchmark-ის გამარტივებულ ამოცანებს ასრულებდა.
18 თვის წინ საუკეთესო მოდელები ბუღალტერებზე დაბალ შედეგს აჩვენებდნენ: ბუღალტერების საშუალო მაჩვენებელი დაახლოებით 37% იყო. დღეს იგივე ამოცანებს თითქმის უშეცდომოდ ხსნიან.
სრული ბენჩმარკი უფრო რთულ სურათს აჩვენებს
სრული APEX Accounting Benchmark გაცილებით დიდია: 160 ამოცანა 10 სიმულირებულ კომპანიაში, რომელიც 40-ზე მეტმა პროფესიონალმა შექმნა; მათი საშუალო გამოცდილება 11 წელია. ამჟამად პირველ ადგილზეა Claude Opus 5.5 შეფასების კრიტერიუმების 61,8%-ით, მას მოჰყვება Fable 5.1 (61,0%) და GPT-6 Astra (57,9%).
თუმცა ამოცანების თითქმის 60% ვერცერთმა მოდელმა ბოლომდე ვერ ამოხსნა. Mercor-ის მიხედვით, AI ჯერ ვერ ხურავს ანგარიშგებას ზედამხედველობის გარეშე.
რა რჩება კვლევის მიღმა
თავად Mercor აღიარებს, რომ კვლევის ამოცანები ზუსტად იმას ამოწმებს, რაშიც AI ყველაზე ძლიერია: დეტალების მოძიებასა და ინსტრუქციების ზუსტად შესრულებას. კვლევამ არ მოიცვა სამუშაოს მნიშვნელოვანი ნაწილები, როგორიცაა კლიენტებთან ურთიერთობა, კოლეგებთან კოორდინაცია და წლების განმავლობაში დაგროვილი კონტექსტის გამოყენება.
ამიტომ, Mercor-ის შეფასებით, ბუღალტერების ჩანაცვლება ვერ მოხდება, თუმცა კომპანია ინდუსტრიაში პროდუქტიულობის მნიშვნელოვან ზრდას ელოდება.
SiTech — AI-გაძლიერებული ვებ დეველოპმენტი
ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.