מרד הקוראים: למה טקסט שנכתב ב-LLM מאבד את קוראיו
המהנדס בריאן קנטריל טוען שהקוראים מזהים מיד טקסט שנכתב במודל שפה גדול, ולעתים קרובות יותר מפסיקים לקרוא אותו; הוא מסתמך על סקר בקרב 668 מפתחים ועל כלי זיהוי חדשים.
המהנדס בריאן קנטריל, אחד מכותבי DTrace ומייסד-שותף של Oxide Computer, פרסם מאמר בבלוג שלו ובו הוא טוען שהקוראים נמצאים במרד גלוי נגד טקסטים שנכתבו בידי מודלי שפה גדולים. לדבריו, קל לזהות טקסט כזה, והנוהג הזה שובר את החוזה החברתי שבין הכותב לקורא.
במאמר מתואר שסימני הכתיבה של מודלי השפה כה מעצבנים עד שהקוראים נוטשים את הטקסט באמצע משפט. קנטריל מסתמך על סקר של סינתיה דנלופ, שבו 668 מפתחים תיארו כיצד הם מגיבים לפוסטים בבלוגים שנוצרו בידי בינה מלאכותית.
מה מצא הסקר
לפי הנתונים שקנטריל מביא, 78% מהמשיבים מפסיקים לקרוא מיד כשהם מזהים מודל שפה, ו-71% ממשיכים הלאה ונמנעים מאותו כותב גם בעתיד. הוא מדגיש שהקוראים אינם מחפשים שלמות לשונית: 98% העדיפו טקסט מקורי של הכותב, גם אם אינו מושלם, על פני טקסט שמלוטש בידי מודל.
קנטריל מזהיר מלראות במשיבים קבוצה שבוחרת את עצמה. קוראים פעילים ברשתות החברתיות הם בדיוק האנשים שהסיכוי שלהם לשתף טקסטים שהם אוהבים הוא הגבוה ביותר — המאמצים המוקדמים וקובעי הטעם של הפרוזה המקוונת.
Pangram והמדיניות של Oxide
ניסיונות זיהוי מוקדמים, הוא כותב, לא היו אמינים: מודלים ששימשו כגלאים פספסו יותר מדי, ובדיקת סימנים שטחיים הייתה רחבה מכדי להועיל. להערכתו, המודל Pangram 3 של Pangram Labs, שהושק בשנה שעברה, היה שיפור גדול, ואילו Pangram 4, שהוצג לפני כחודש, הוא קפיצה של ממש, עם שיעור נמוך של חיוביים שגויים ושליליים שגויים.
חברת Oxide הרחיבה את המסמך הפנימי RFD 576 כך שכתיבה ציבורית היוצאת תחת שם החברה מחויבת בדיווח של Pangram שלפיו אדם כתב אותה. קנטריל ממליץ לארגונים שמחשיבים את האותנטיות של הקול המוסדי שלהם לאמץ מדיניות דומה.
ההקבלה לספאם
קנטריל משווה טקסטים שנכתבו בידי מודלי שפה לספאם בדואר אלקטרוני. בתחילת שנות האלפיים, הוא נזכר, היו חששות אמיתיים שספאם יביא למותו של הדואר האלקטרוני; עד סוף העשור הסינון השתפר עד כדי כך שפגע בכלכלה של הספאם, והתווית "ספאם" הפכה להרסנית באמת עבור עסקים לגיטימיים.
לדבריו, אותה דינמיקה עשויה לחול כעת על פרוזה שנכתבה בידי בינה מלאכותית: אם הקוראים יבחרו להתעלם מכותב, אותו כותב הרס בעצמו את כל תכליתה של הפרסום. עצתו פשוטה — השתמשו במודל שפה כעורך ולא ככותב, כי פרומפט אינו מאמר.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.