
ABBYY-მ FineParser გამოუშვა — OCR CPU-ზე, AI-კონვეიერისთვის
ABBYY-მ თავისი FineReader OCR გადააკეთა FineParser-ად — თვითგანთავსებად ინსტრუმენტად, რომელიც Docker-ში, CPU-ზე მუშაობს, დოკუმენტის განლაგებას ინარჩუნებს და ტექსტს დიდი ენობრივი მოდელებისთვის ამზადებს.
FineReader AI-ის კონვეიერისთვის გადაკეთდა
ABBYY-მ თავისი FineReader OCR ძრავა თვითგანთავსებად (self-hosted) ინსტრუმენტად შეფუთა, რომელიც დოკუმენტებს სტრუქტურირებულ ტექსტად აქცევს და AI სისტემებს ამ ტექსტის გამოყენების საშუალებას აძლევს. ახალი პროდუქტი — FineParser — Docker-ის კონტეინერში, CPU-ზე მუშაობს და GPU არ სჭირდება. მიზანია, ტექსტის ამოღების დროს დოკუმენტის განლაგება უცვლელად შეინარჩუნოს.
FineParser სხვადასხვა ენაზე შესრულებული დოკუმენტების სურათებს იღებს და მათ სტრუქტურირებულ, ფორმატირებულ ტექსტად გარდაქმნის, რომლის გენერაციული AI მოდელებით დამუშავებაც შემდეგ შესაძლებელია. ეს ერთადერთი დანიშნულება არ არის: ABBYY-ის თქმით, ინსტრუმენტი დაბეჭდილი ტექსტის თანამედროვე CMS-ში გადატანას, არქივირებას ან წარმოების კონვეიერის ერთ-ერთ საფეხურსაც ემსახურება.
„დეტერმინისტული“ ამოღება, გენერაციული გამოტანა
ABBYY FineParser-ის მიდგომას „დეტერმინისტულ“ AI-ს უწოდებს. ძრავა ტექსტსა და დოკუმენტის სტრუქტურას ამოიღებს და არა მათ დამაჯერებელ ვერსიას აგენერირებს; შედეგი შემდეგ გენერაციულ AI სისტემას გადაეცემა, რომლის პასუხებიც გაცილებით ნაკლებად პროგნოზირებადია.
სტრუქტურის შენარჩუნება ნიშნავს სვეტების კითხვის თანმიმდევრობით ამოცნობას, აგრეთვე სათაურებსა და ცხრილებს — მათ შორის უჩარჩო ცხრილებს — ნაცვლად ამოღებული ტექსტის არეული მასისა. ABBYY-ის ინფორმაციით, FineParser ხელნაწერ ტექსტსაც და 200-ზე მეტ ენასაც უმკლავდება. დეველოპერები დოკუმენტებს REST API-ს მეშვეობით აგზავნიან და შედეგს უბრალო ტექსტის, JSON-ის ან DocLang-ის სახით იღებენ — DocLang კომპაქტური ფორმატია, დიდი ენობრივი მოდელებისთვის შეყვანისთვის განკუთვნილი.
უფასო ტარიფი, ლიცენზიის სერვერი და ღია კომპონენტები
თავად FineParser ღია კოდის მქონე არ არის, თუმცა ABBYY GitHub-ზე რეპოზიტორიას ინახავს მაგალითებისა და საზოგადოების მხარდაჭერისთვის. თვითგანთავსებად ინსტრუმენტს უფასო ტარიფი აქვს — თვეში 1 000 გვერდი ერთი წლის განმავლობაში. ფასიანი ტარიფები ვალიდაციისთვის ლიცენზიის სერვერს უკავშირდება, სრულად ოფლაინ განთავსებას კი, ABBYY-ის თქმით, Enterprise პლანი სჭირდება.
კომპანია ასევე სთავაზობს NeoML-ს — პროგრამირებადი მანქანური სწავლების ჩარჩოს, რომელიც ღია კოდის მქონეა და GitHub-ზეა გამოქვეყნებული — და OCR SDK-ს მათთვის, ვისაც FineReader-ის ძრავის საკუთარ პროდუქტებში ჩაშენება სურს.
რატომ არის ეს მნიშვნელოვანი
FineParser-ის მთავარი არგუმენტი მარტივია: სანამ დიდი ენობრივი მოდელი დოკუმენტს რაიმე სასარგებლოს გააკეთებინებს, ვიღაცამ ეს დოკუმენტი სწორად უნდა წაიკითხოს. ABBYY-ს სჯერა, რომ მის ათწლეულების მანძილზე დახვეწილ OCR მიდგომას — CPU-ზე მუშაობა, განლაგების შენარჩუნება და ტექსტის გენერაციის სხვა ინსტრუმენტებისთვის დატოვება — AI-კონვეიერში ადგილი ჯერ კიდევ აქვს. ზოგჯერ ყველაზე ძველმოდური ნაწილია სასარგებლო.
SiTech — AI-გაძლიერებული ვებ დეველოპმენტი
ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.