חזרה
מאמר של Pydantic: האדם בלולאה עייף
SiTech AI Team2 წთ. საკითხავი

מאמר של Pydantic: האדם בלולאה עייף

לורה סאמרס מ-Pydantic טוענת שתכנות עם מודלי שפה גדולים הוא גם שימושי וגם מערער יציבות, ושמה שמתיש את המפתחים אינו חוסר היכולת אלא עייפות הפיקוח על מה שהמכונה מייצרת.

עייפות הפיקוח

לורה סאמרס מ-Pydantic פרסמה מאמר בשם “The Human-in-the-Loop is Tired”, שבו היא טוענת שתכנות עם מודלי שפה גדולים הוא בו-זמנית שימושי באמת ומערער יציבות באמת, ושהתעלמות מהחצי השני של המשפט תסתיים בשחיקה של מפתחים. Pydantic מפתחת כלי אימות נתונים ומסגרת לסוכני AI.

בלב המאמר עומד מה שסאמרס מכנה עייפות הפיקוח. עמיתהּ Douwe, שמתחזק את מסגרת Pydantic AI, סיפר שהוא מתעורר לבוקר עם כשלושים pull request — כל אחד מהם נפתח בלילה על ידי ה-AI של מישהו — וצריך לקבל החלטה מהירה לגבי כל אחד מהם. הפיתוי להעביר את הסקירה עצמה למודל היה גדול, אבל, כפי שהוא ניסח זאת, “בשלב הזה, מה אני עוד עושה כאן?”

סאמרס מתארת כיצד בילתה כמעט יומיים שלמים בכתיבת תוכנית עבור מודל — מבהירה ומנסחת מחדש — ורק שהמודל העביר בכל זאת React hook לקובץ הלא נכון או המציא רכיבים שאינם קיימים. אלה שגיאות של לכידות ולא של יכולת: המודל יודע לייצר קוד סביר, אבל לא תמיד מצליח לשמור על כוונה אחת לאורך שינוי מורכב.

בעיית פונקציית התגמול

את המנגנון שמאחורי זה היא מכנה בעיית פונקציית התגמול האנושית. בלמידת מכונה פונקציית תגמול אומרת לסוכן מה נחשב טוב; כתיבת קוד ביד מעולם לא הייתה קלה, אבל היא הייתה מלאה בתגמולים קטנים — לראות את הקומפילציה עוברת, להרגיש שליטה. עבודה בסיוע LLM מבטלת חלק גדול מזה ומחליפה אותו בסקירה ובפיקוח: החלק המהנה מתכווץ, המתיש גדל.

גם העצימות עולה. סאמרס מצטטת מחקר של Berkeley Haas שלפיו AI לא מפחית עבודה אלא מגביר אותה, ומתארת איך כתבה פרומפטים כמעט עד שתיים בלילה, כי התוכנית נראתה כמעט מוכנה. בדיחה של עמית — פתח חמישה מופעים של Claude במקביל — מתארת היטב את הרגע: מספר הדברים שאפשר להתחיל גדל בחדות, ואילו מספר הדברים שאפשר לסיים מתוך מחשבה לא השתנה, כי לשם כך עדיין נדרש מוח אחד.

תקדים ומה שנשאר

סאמרס משווה את הרגע למעבר של 2009 מפריסות ברוחב קבוע לעיצוב רספונסיבי. מעצבים שנאו לאבד שליטה ברמת הפיקסל, אבל המלאכה לא מתה: חוש הפרופורציה, ההיררכיה, חשיבה מערכתית ועיצוב לאי-ודאות נעשו רלוונטיים יותר. השינוי הנוכחי מהיר יותר, אך הדפוס נשאר.

כשקוד סביר הוא זול, מה שמבדיל הוא טעם, ניואנס, דעות ארכיטקטוניות מגובשות והחלטות לא-שגרתיות שנשענות על מומחיות אמיתית. נוצרות גם שיטות חדשות — למשל “pre-mortem”, שבו מופע חדש מניח שהתוכנית נכשלה באופן קטסטרופלי ומחפש את הסיבות. המסקנה מדודה: צוואר הבקבוק מעולם לא היה הקוד, אלא הקשב האנושי ושיקול הדעת ההנדסי. בני האדם עדיין בלולאה — רק עייפים.

SSiTech

SiTech — פיתוח אתרים בכוח ה-AI

אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.