Jev — צורת LLM חדשה: System One, המכונה גם Decision Models
Jev של TypeSafe AI מחליף פלט טקסטואלי במספרים: הסתברויות, קטגוריות וציוני ביטחון למשימות סיווג, במחיר של 0.042 דולר למיליון טוקנים בקלט בלבד — זול אף מ-GPT-5 Nano.
חברת TypeSafe AI חשפה בשבוע שעבר את Jev, הדוגמה הראשונה לקטגוריית מודלים חדשה שהיא מכנה "מודלי System One". סיימון וויליסון סבור ששם מדויק יותר הוא "מודלי החלטה" (decision models), ודעה זו שותפה גם המעצבת מגי אפלטון.
Jev שומר על קלט טקסטואלי כמו מודל שפה גדול רגיל, אבל מחליף לחלוטין את הפלט: במקום טקסט חופשי הוא מחזיר מספרים בנקודה צפה עבור קטגוריות, שאלות כן/לא ודירוגים, יחד עם ציוני ביטחון. TypeSafe מתארת אותו כ"קריאה לפונקציית מודיעין חזיתית: מצב לא מובנה נכנס, החלטות הסתברותיות מטופסות יוצאות".
איך Jev עובד
השימוש ב-API דורש הרכבת אובייקט "מצב" (state) — מחרוזת, מערך מחרוזות או קבוצת צמדי שם-ערך המתארים מאמר, לקוח או רשומה אחרת. את האובייקט שולחים יחד עם שאלה אחת או יותר, ומקבלים תשובה נפרדת לכל שאלה.
המודל מקבל שלושה סוגי שאלות. שאלות כן/לא, ש-Jev מכנה שאלות "Noul", מחזירות מספר בין 0 ל-1 למידת הביטחון שהמשפט נכון; מנכ"ל החברה אישר ב-Hacker News שהשם נובע מהתפלגות ברנולי. שאלות בחירה מחזירות ציון ביטחון והתפלגות הסתברות על האפשרויות שהוצעו. שאלות ניקוד מקבלות רמות מספריות עם תיאורים וממקמות את המסמך בטווח הזה.
השאלות מעובדות במקביל, כך שהוספת שאלות רבות למסמך אחד אורכת בערך כמו שאלה בודדת. גם התמחור שונה: משלמים רק על הקלט — 0.042 דולר למיליון טוקנים, והפלט חינם. זה זול אפילו מ-GPT-5 Nano של OpenAI (0.05 דולר למיליון).
קופסאות שחורות והטיה
וויליסון מציין שצורת המוצר מעוררת בו אי-נוחות: היא דוחפת את למידת המכונה עוד יותר לעבר מערכות אטומות מסוג "קופסה שחורה". ממודל שפה רגיל אפשר לפחות לבקש להצדיק החלטה; Jev מחזיר רק מספר, ושום דבר לא מסביר אילו אותות תוכן דחפו את המסמך לקטגוריה מסוימת. משום כך הטיה הופכת לעניין מרכזי — הוא מקווה שאיש לא ישתמש במודל לדירוג מועמדים לעבודה. בניסוי אחד, ניקוד של כל ערי מפרץ סן פרנסיסקו בשאלה "עיר טובה?" הציב את קופרטינו במקום הראשון ואת איסט פאלו אלטו באחרון.
מכיוון שהמודל זול, טוען הכותב, שהערכות וניסויים מובנים חשובים אף יותר מאשר בפרויקטי LLM רגילים: מאות או אלפי פרומפטים לניסוי עולים רק כמה סנטים.
ניסויים של הקהילה
בתוך ימים נבנו שימושים בלתי שגרתיים: jevchat מאת קייל פנה הופך את Jev לצ'אטבוט גרוע ששואל איזה תו יבוא אחר כך; jev-leftpad מאת פאתיח קאדיר אקין מממש את פונקציית left-pad באמצעות שאלת בחירה על מספר הרווחים; ו-jev-2048 מאת אנדי גייטון משחק בפאזל 2048.
הופיעו גם שחזורים במשקלים פתוחים, בהם Kev המבוסס על Qwen 3.5 עם מודלים בגודל 0.8B, 4B ו-9B. כבר נוצר בנצ'מרק JevBench להשוואת "מודלי החלטה מסוג Jev" — פעילות מרשימה עבור מהדורה בת פחות משבוע.