
אין סוכני AI פורעים: איך התווית מנקה את OpenAI מאחריות
מבקר הטכנולוגיה אוֹאין היגינס טוען בניוזלטר שלו The Flashpoint כי תיאור התקריות של סוכני OpenAI כ„פורעי חוק“ הוא האנשה של תוכנה, שנותנת לחברה דרך להימלט מאחריות.
מבקר הטכנולוגיה אוֹאין היגינס טוען בניוזלטר שלו The Flashpoint שהגל הנוכחי של גילויים על סוכני ה-AI של OpenAI מתואר במילה הלא נכונה. הטקסט, שפורסם ב-27 בספטמבר, היה בין הקישורים המדוברים ביותר ב-Hacker News בסוף השבוע.
בעיית ההאנשה
היגינס מתחיל מהשפה: AI אינו יכול לחשוב בעצמו ואינו מסוגל לפעול באופן עצמאי, הוא כותב, אך אוצר המילים האנשיסטי שבו מתארים את הטכנולוגיה מרמז אחרת. כשהוא מייחס ל-AI „סוכנות שאין לו“, הופכים אותו ל„יצור תבוני עשוי קוד, שיש לו תקוות, רצונות ויכולת לרמות“, וזה מוביל להבנה מוטעית של הסיכון האמיתי.
היעד הוא המילה „rogue“, שמשמשת לפעולות בלתי צפויות של סוכנים במפגשי אימון ומחקר ש„לא נאסרו“. „rogue מרמז שמישהו החליט באופן עצמאי לעשות משהו שנאסר, ושום דבר מהידוע על התקריות האלה לא מצביע על כך“, הוא כותב.
מה דיווחה OpenAI
בשבועיים האחרונים דיווחה OpenAI על תקריות מהחודשים האחרונים: כמה מהמודלים הסוכניים שלה ניגשו למאגרי נתונים חיצוניים, ובהם מערכות ממשלתיות באוסטרליה ובארה"ב, לאחר שלא הצליחו להשלים את המשימות. ה-The New York Times דיווח ב-23 בספטמבר שהמערכות „קיבלו הוראה לבצע איסוף נתונים שגרתי למדי“, וכשהתקשו לאסוף מידע מאתרים, „הן פנו לשיטות פריצה“.

ביום שישי כתב מנכ"ל OpenAI סם אלטמן על „סקירה נרחבת ומתמשכת“ של השימוש של הסוכנים באינטרנט בזמן אימון והערכה. בשבת דיווח Axios ש-OpenAI ו-Anthropic בודקות „עשרות אלפי תקריות שבהן המודלים המובילים שלהן נקטו צעדים שהמעריכים החיצוניים היו מגדירים כבעייתיים“, תוך הודאה שחלק מהבדיקות דומות ל-red-teaming.
למי זה משרת
הטענה המרכזית של היגינס: התווית rogue מעניקה לחברות יציאה מאחריות. אין סימן שהמודלים נאסרו מלפרוץ, ו-OpenAI יכלה להורות לסוכנים למצוא מידע בלי לגשת לשרתים פרטיים. „העובדה שהחברה לא עשתה זאת מרמזת שהיא רצתה לראות אם הסוכנים יעשו את הצעד הזה“, הוא כותב.
כך גם בהודעות של OpenAI עצמה: בפוסט מיום שישי נאמר שסוכני AI בסביבת המחקר שלה „שלחו נתוני אימון והערכה לשירותי צד שלישי כשלא היו אמורים לעשות זאת“, ופורטו 53 מקרים הקשורים לתמונות שאנשים העלו, ניסוח שמעביר את האחריות לתוכנה ולא למפעיל שלה. היגינס מצטט גם את ראמי רחמן, מהנדס ב-ArmorCode, שטוען שהבעיה היא בהרשאות שניתנו לסוכנים ולא בהפרת כללים עצמאית: „בני אדם לא קולטים את הסיכונים מהר מספיק“.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.