
Laya: מנוע החלטות פתוח שנבנה שנה לפני שמעבדה כינתה את הרעיון חדש
אחרי שמעבדה קדמית ממומנת היטב השיקה מודל דומה כפריצת דרך מדעית, שחרר מהנדס את Laya: מודלי החלטה פתוחים מסוג System 1 שמחזירים הסתברויות מכוילות תוך 32.8 מ״ש וללא עלות API.
מהנדס שפרסם מודלים לא-אוטורגרסיביים לקבלת החלטות לפני שנה שחרר חלופה פתוחה לחלוטין, לאחר שמעבדה קדמית ממומנת היטב הציגה ארכיטקטורה דומה כפריצת דרך מדעית חדשה.
רעיון בן שנה שהוצג כחדש
ננדייקישור מוקונוט, מייסד ומנכ״ל ConvAI Innovations, כותב שבנה את הגישה במרץ 2025: מאמר ב-arXiv על מסלולי המרה רציפים, משקולות מודל ומאגר נתונים פתוח ב-Hugging Face. בספטמבר 2026 השיקה TypeSafe AI — שנוסדה בידי דיוגו אלמיידה, ממציא-שותף של ChatGPT — את Jev, שאותו הוא מתאר כאותו רעיון של החלטות לא-אוטורגרסיביות, אך בלי מאמרים טכניים, משקולות פתוחות או נתוני אימון פתוחים. Jev דוגם במקביל בעזרת מה שהיא מכנה RLCD, למידת חיזוק להחלטות מכוילות, וגובה 0.042 דולר למיליון טוקנים בקלט, כשזמן התגובה האופייני הוא כ-150 מ״ש.
מהו Laya
במקום להישאר ממורמר, הוא בנה את הרעיון מחדש כ-Laya, מנוע החלטות מסוג System 1: הוא אינו מייצר טקסט, אלא רק התפלגויות הסתברות מעל סכמות מובנות. הוא עונה על שלושה פרימיטיבים — choice, שבוחר מפתח אחד ממילון ומחזיר את ההתפלגות וציון ביטחון מכויל; score, שממקם מסמך על סולם סדורי כמו 0 עד 3; ו-noul, שאלה בוליאנית שמחזירה P(true). כיוון שמרחב הפלט הוא מספרים בלבד, המודל אינו יכול להזות ו-JSON פגום בלתי אפשרי, טוען הכותב. על אנקודרים דו-כיווניים הוא עונה תוך 32.8 מ״ש על GPU יחיד, או 7.2 מ״ש לשאלה באצווה, שלפי העמוד מהיר פי שישה עד שמונה מ-Jev, עם רישיון Apache 2.0 וללא עלות API.
שלושה צ׳קפוינטים ונתב
המשפחה כוללת שלושה צ׳קפוינטים במאגר אחד ב-Hugging Face: laya (ModernBERT-large, 421 מיליון פרמטרים, הקשר של 512 טוקנים) לסיווג באנגלית ולמיון דואר; laya-multilingual (mmBERT-base, מילון של 256 אלף טוקנים, 322 מיליון פרמטרים) ליותר מ-100 שפות; ו-laya-typed-decisions לתרחישי סוכנים בדיוק של 0.766. סריקה של 51 שפות בבנצ׳מרק MASSIVE הראתה כיצד מודלים אנגליים קורסים מחוץ לכתב הלטיני: בחמרית המודל השיג 0.000 דיוק בביטחון ממוצע של 0.952. הביטחון לא ירד מעולם מתחת ל-0.885, בין אם הדיוק היה 82% ובין אם אפס, ולכן סינון לפי ביטחון אינו מגן — החלטת הניתוב חייבת להתקבל לפני המעבר קדימה. הנתב של Laya בודק כתבי יוניקוד ב-22 אלפביתים ומוסיף 0.09 מ״ש לאנגלית, 0.54 מ״ש לכתב הודי ו-0.73 מ״ש ל-JSON מקונן גדול.
בנצ׳מרקים ומגבלות כנות
בבנצ׳מרקים משותפים המערכת המנותבת מדווחת 0.950 מול 0.910 של Jev ב-AG News ו-0.595 מול 0.480 ב-DAIR Emotion, עם שגיאת כיול צפויה של 0.081 מול 0.246 ושהיה חציונית של 32.8 מ״ש מול 236–276 מ״ש. העמוד מפרט גם תקרות: סכמות choice נחלשות מעל 20 אפשרויות — ב-Banking77 עם 77 תוויות השיגה Laya 0.425 מול 0.870 של Jev; מודלים בסיסיים מגיעים לכ-0.35 ללא כיוונון; והתאמת סקלר טמפרטורה אחד לכל סוג שאלה מפחיתה את שגיאת הכיול מ-0.466 ל-0.081.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.