חזרה
גרובר מבקר את תוכנית Anthropic לסמן ב"סימן מים" כל טקסט של Claude
SiTech AI Team2 წთ. საკითხავი

גרובר מבקר את תוכנית Anthropic לסמן ב"סימן מים" כל טקסט של Claude

ג'ון גרובר מ-Daring Fireball מכנה את התוכנית של Anthropic להטביע סימני מים סטטיסטיים בכל טקסט של Claude שיבוש של הכתיבה, ומציין שרק החברה מחזיקה במפתח לגילוים.

ג'ון גרובר, מחבר הבלוג Daring Fireball, פרסם ביקורת מפורטת על תוכניתה של Anthropic להטביע "סימני מים" סטטיסטיים בכל טקסט שמייצרים מודלי Claude שלה ברחבי העולם, וכינה את השיטה שיבוש של הכתיבה. החברה מיישמת את המערכת כדי לעמוד בקוד ההתנהגות של האיחוד האירופי לשקיפות תוכן שנוצר ב-AI, שאותו חתמה Anthropic ביולי 2026 יחד עם כ-190 חותמים נוספים.

איך פועל סימן המים

בתחילה אמרה Anthropic רק ש-Claude "שוזר סימן מים בלתי מורגש ישירות בטקסט עצמו", בלי להסביר את המנגנון. פוסט מאוחר יותר, "How Claude's Text Watermark Works", מתאר שיטה סטגנוגרפית: בכל נקודה שבה המודל בוחר את הטוקן הבא, האפשרויות מסודרות באופן דטרמיניסטי לרשימות "ירוקות" ו"אדומות" לפי מפתח סודי, ולמילים ברשימה הירוקה ניתנת הסתברות מעט גבוהה יותר להיבחר. הגילוי בודק אם קטע מכיל יותר מילים "ירוקות" מאשר המקריות הייתה חוזה — מבחן סטטיסטי שדיוקו עולה עם האורך. הסימון חל על טקסט שנוצר שארוך מ-200 טוקנים, ולפי Anthropic הוא מיושם גלובלית מההשקה משום שלחברה אין דרך יציבה להגבילו לפי אזור.

ההתנגדויות

הטיעון המרכזי של גרובר הוא ששתי מילים נרדפות אינן נושאות משמעות זהה לחלוטין, ולכן הטיית בחירת הטוקנים — ולו במעט — לטובת התאמות פחות טובות פוגעת בטקסט בכוונה. הוא מוסיף שהמפתח הסודי ליצירת הסימנים ולזיהויים נמצא רק בידי Anthropic: המשתמשים אינם יכולים לאמת דבר בעצמם, וקוראים עלולים להתמודד עם האשמות בלתי ניתנות להוכחה בדבר כתיבה ב-AI. מכיוון שהשיטה נשענת על בחירת מילים, היא שורדת העתקה-הדבקה ואף, לפי מאמר אחד שמצוטט, עשויה לשרוד תרגום; המבקרים מציינים שמי שנחוש לרמות פשוט יעביר את הטקסט בכלי פרפרזה. טיעונים דומים העלו מייקל לופ, ג'ף גמט וג'יימס פדולסי — שלדבריו יישום ברמת המודל חורג מהמינימום שהחוק דורש.

ההקשר הרחב

מערכת דומה של גוגל, SynthID, כבר מופעלת על טקסטים של Gemini; במאמר ב-Nature דיווח הצוות של DeepMind ששיעורי הדירוג החיובי והשלילי בנתונים מסומנים ולא מסומנים נבדלו ב-0.01% וב-0.02%, פער שהמחברים הגדירו כלא מובהק סטטיסטית. גרובר דוחה את הראיות האלה כגסות מדי לזיהוי הרעה בבחירת מילים, בעודו מודה שהמתמטיקה שמאחורי השיטה מעניינת. OpenAI הצהירה שמטרתה להרחיב אותות מקור לכל סוגי התוכן, כולל טקסט, בלי לפרט אם הדבר יהיה חובה לכל המשתמשים. הפרשה הפכה למקרה מבחן לאופן שבו כללי שקיפות של טקסטים ישפיעו על כותבים הרחק מחוץ לאיחוד האירופי.

SSiTech

SiTech — פיתוח אתרים בכוח ה-AI

אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.