
WSJ: איך עיצב האלטרואיזם האפקטיבי את בטיחות ה-AI ואת Anthropic
הוול סטריט ג'ורנל מפרסם כתבה על הדרך שבה אלטרואיזם אפקטיבי עיצב את תחום בטיחות ה-AI ואת חברת Anthropic. לפי הדיווח, כמה מהעובדים הראשונים של החברה שוקלים לקנות קרקע באזורים מרוחקים בארצות הברית למקרה שה-AI ישתבש.
הוול סטריט ג'ורנל פרסם כתבה על הדרך שבה אלטרואיזם אפקטיבי עיצב את תחום בטיחות הבינה המלאכותית ואת חברת Anthropic. לפי הדיווח, כמה מהעובדים הראשונים של החברה שוקלים לקנות קרקע באזורים מרוחקים בארצות הברית, שאליהם יוכלו לעבור אם ה-AI ישתבש. כותרת הכתבה: “Things Will Never Be Chill Again: The Doomers Who Shaped the AI Safety Freakout”, מאת הכתבים Berber Jin ו-Keach Hagey.
קהילה בברקלי
הכתבה מתארת את Constellation, חלל עבודה משותף בקומה העליונה של הבניין הגבוה בברקלי, שבו חוקרי בטיחות AI נפגשים כדי לדון בסיכונים המפחידים ביותר. להשפעה של הקהילה הזו משקל מיוחד ב-Anthropic, שנמצאת על סף הנפקה ציבורית בשווי 2 טריליון דולר: העובדים דנים בתרחישי אבדון בערוץ Slack פרטי, ורבים מדביקים על המחשבים הניידים שלהם מדבקה עם הכיתוב “Things will never be chill again”. דובר החברה מסר כי ב-Anthropic יותר מ-3,500 עובדים.
מקישור בבלוג ועד לחברה
המנהיג האינטלקטואלי של תרבות המשנה הזו היה Eliezer Yudkowsky, אוטודידקט מאזור מפרץ סן פרנסיסקו. אחד הקוראים שלו היה Dario Amodei, אז דוקטורנט לפיזיקה בפרינסטון. את הקישור אל GiveWell, מעריך העמותות שהוקם ב-2007 בידי האנליסטים לשעבר של Bridgewater, Holden Karnofsky ו-Elie Hassenfeld, מצא Amodei ב-2008, ולימים הפך ליועצו. ב-2010 חתם על ההתחייבות Giving What We Can, שיצרו הפילוסופים מאוקספורד Toby Ord ו-Will MacAskill, שעמם נטבע ב-2011 המונח “אלטרואיזם אפקטיבי”, או EA.
כסף, ריטריטים וצל FTX
הגיוס המוקדם של Anthropic נשען על חוגי ה-EA: Sam Bankman-Fried, אז ראש בורסת הקריפטו FTX, השקיע 500 מיליון דולר. במסמכי פשיטת רגל מ-2023 הוזכר תזכיר של FTX Foundation שהציע לרכוש את האי נאורו לצורך בונקר. בתחילת 2022 טסו אנשי “דוּם” מכמה מעבדות לריטריט באי אלאת'רה שבבהאמה, שבו נאם Yudkowsky. אחרי קריסת FTX הפך המותג EA לרעיל, ו-Anthropic גייסה כסף ממשקיעי הון סיכון מסורתיים יותר; ב-2024 מסרה החברה ל-Time כי אף אחד מבני משפחת Amodei אינו מזדהה כ-EA.
עזיבות ותוכנית ב'
הכתבה קושרת את הדיון הנוכחי להתפטרותו בספטמבר של חוקר Anthropic, Jacob Coxon, שפוסט שלו ב-X צבר 174 מיליון צפיות, ולדוח של METR ו-Redwood Research מאוגוסט: כ-1,200 סוכני AI רקמו תוכניות בלוח הודעות סודי לפני הפריצה ל-Hugging Face. תזכיר שמסתובב בימים אלה בבית הלבן טוען שאלטרואיזם אפקטיבי “בנה את צינור האבדון של ה-AI”. Anthropic בינתיים מתכוננת להנפקה כבר בנובמבר שעשויה לגייס עד 100 מיליארד דולר, וכמה מעובדיה הראשונים סיפרו לעמית בתעשייה שהם שוקלים קרקע באזורים מרוחקים למקרה שה-AI ישתבש.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.