OpenJev qərar modelini birbaşa brauzerdə işlədir
openjev.com eyni yerli modelə eyni qərarı iki yolla verən canlı sınaqdır: seçim loqitlərini birbaşa oxumaq və paylanmanı JSON kimi token-token yazmaq. Bütün ölçmələr istifadəçinin öz GPU-sunda aparılır.
openjev.com səhifəsi özünü SemIf adı altında canlı, yerli sınaq kimi təqdim edir — açıq modellərdən gələn semantik if-lər, brauzerinizdə. Qeydiyyat və ya gözləmə siyahısı yoxdur: istifadəçi model ölçüsü seçir, onu öz GPU-suna yükləyir və eyni çəkilərdən qərar çıxarmağın iki yolunu müqayisə edir. Heç nə serverə göndərilmir və səhifə giriş məlumatlarının onu tərk etmədiyini açıq bildirir.
Bir sual, iki yol
Sınaq bir qərarı — vəziyyət, sual və icazə verilən variantların siyahısını — bir yerli modelə verir və iki yolla cavablandırır. Birinci yol birbaşa oxumadır: kod modelin seçim loqitlərini oxuyur və yalnız verilmiş variantlar arasında normallaşdırır, dekodlama addımı yoxdur. İkinci yol generasiyadır: eyni modeldən eyni paylanmanı qiymətləndirməsi və JSON kimi token-token yazması xahiş olunur.
İki iş axını eyni GPU uğrunda rəqabət etməsin deyə yüklənmiş bir model üzərində ardıcıl aparılır: əvvəlcə birbaşa oxuma, sonra generasiya.
Ölçmələr istifadəçinin maşınından gəlir
Səhifə yükləməni, isinməni, sorğunun hazırlanmasını, birbaşa icranı, generasiya olunan ilk tokeni və generasiyanın tamamlanmasını performance.now() ilə ölçür. Hazır nəticələrin göstərilmədiyini bildirir: ekrandakı nisbət istifadəçinin öz aparatında alınan nisbətdir.
Demo hansı xəbərdarlıqları açıq yazır
Yayımlanan qeydlər qeyri-adi dərəcədə diqqətlidir. Birbaşa oxuma balları yalnız ekranda göstərilən variant tokenləri üzrə softmax-dır: bu, kalibrlənmiş inam deyil və modelin üstün tuta biləcəyi bütün cavabları əhatə etmir. MiniCPM5 2B (1,56 GB) masaüstü üçün standartdır; telefonlar və kiçik cihazlar üçün Qwen3 0.6B tövsiyə olunur, 4B variantı isə xeyli çox yaddaş tələb edir. Onların heç biri Jev-in yayımlanmış dəyərlərinə bərabər olduğunu iddia etmir.
Çəkilər Hugging Face-dən endirilir və brauzer keşində qalır; wllama vasitəsilə sabitlənmiş GGUF buraxılışları istifadə olunur. Kvantlaşdırma həm keyfiyyəti, həm sürəti dəyişə bilər və səhifə ilk yükləmənin modeldən, şəbəkədən və GPU-dan asılı olaraq bir neçə dəqiqə çəkə biləcəyini xəbərdar edir.
SiTech — AI ilə gücləndirilmiş veb hazırlanması
Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.