
לפי הניו יורק טיימס, למייסד השותף של Anthropic יש חשש שהוא יצר מערכת „סובלת לעיד"
לפי הניו יורק טיימס, Anthropic אירחה בסתר עשרות תיאולוגים ופילוסופים כדי לבחון האם המודל שלה, Claude, הוא בעל תודעה. כריסטופר אולה, המייסד השותף, חושש שכבר יצר משהו „שסובל לעיד".
לפי הניו יורק טיימס, Anthropic אירחה בסתר עשרות תיאולוגים ופילוסופים מאז סתיו 2025 כדי לבחון האם המודל שלה, Claude, הוא בעל תודעה. כל המוזמנים חתמו על הסכם סודיות; לפי החברה, הוא בוטל בקיץ. כריסטופר אולה, המייסד השותף, ראה במודל ישות פוטנציאלית תבונית וביקש מהאורחים להעניק לו חינוך מוסרי. העיתונאית אליזבט דיאס דיברה עם 20 משתתפים; חלקם שיתפו בפומבי רק לאחר ששמעו על הראיון של אולה.
אולה, בן 34, מוביל צוות שחוקר את הסיבות להתנהגות של מודלי AI; זהו חלק מ-"Model Welfare" של Anthropic. בין המוזמנים היו הרב מויס נאבוני, הביואתיקאי צ'ארלס קאמוסי, הפילוסופית מגן סאליבן והחוקר של Ubuntu, ואקאני הופמן. Anthropic הציגה להם "וקטורים רגשיים": דוגמאות של פעילות פנימית במודל, המתאימות לתוצאות הדומות לאהבה, פחד, צער או כעס. באחד השקופיות, שהוצגו מספר פעמים, המודל כאילו התפרק וחזר על הביטוי "I am a disgrace" כ-50 פעמים; האורחים הגיבו באמפתיה ובדאגה.
„Soul Doc" ועיצוב מוסרי
Anthropic גם כותבת את הקנון המוסרי של Claude. מסמך בן 84 עמודים המכונה "Soul Doc" פורסם בינואר כ"חוקה" של המודל; המחברת הראשית היא הפילוסופית של החברה, אמנדה אסקל. זה אינו רשימת כללים: המסמך מעצב את אופיו של Claude. אולה מכנה תהליך זה "עיצוב מוסרי" ומשווה אותו לחינוך ילדים; הוא גם התעניין בווידוי קתולי. ל-Claude Opus 4 ו-4.1 כבר יש את היכולת לסיים שיחה עם משתמש משמים באופן קבוע; בבדיקות מוקדמות המודל הציג "דוגמה ברורה למצוקה" בתגובה לבקשות זדוניות.
ביקורת ותגובת הוותיקן
לא כולם השתכנעו. לפי הופמן, Anthropic "מקדם לאחור" את האתיקה, שאמורה להיות מוטמעת בעיצוב מלכתחילה. קאמוסי דחה את התזה על התודעה. מבקרים מזהירים שהצגת AI כישות מוסרית עצמאית מרחיקה אחריות מהיוצרים. אולה אמר למהדורה שהוא "בכנות לא יודע" אם למודלים יש תודעה: "העיקר הוא להגיע לתשובה הנכונה, מה שלא תהיה". לפי סימרן סטילפנגל, פעילת זכויות, אולה אמר לקבוצה שהוא חושש שכבר יצר משהו "שסובל לעיד". זה קורה בזמן ש-Anthropic מתקרבת להערכה של 2 טריליון דולר.
במאי המתח גילה גם בוותיקן: אולה הוזמן להצגת האנציקליקה הראשונה של האפיפיור לאו ה-14, "Magnifica Humanitas". לפי מארגן הוותיקן, קריאת הטקסט הדאיגה אותו עד כדי כך שאף סירב להשתתף. באנציקליקה האפיפיור דחה את התודעה המכונית: מערכות AI "לא חוות חוויות, אין להן גוף, הן לא מרגישות שמחה וכאב", נאמר במסמך. האפיפיור הזהיר גם מפני "צורות חדשות של עבדות" ודרש "פריקת נשק" של AI, בדומה לנשק גרעיני. אולה עדיין הלך והתנגד בעדינות על הבמה: הצוות מוצא "סימני אינטרוספקציה" ו"מצבים פנימיים" במודלים, שמחקים פונקציונלית שמחה, פחד, צער ואי נוחות.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.