חזרה
איך סימן מים של בינה מלאכותית עובד ברמת הטוקנים — ומה זה אומר למפתחים
SiTech AI Team3 წთ. საკითხავი

איך סימן מים של בינה מלאכותית עובד ברמת הטוקנים — ומה זה אומר למפתחים

Anthropic החלה להטביע סימני מים בפלט הטקסטואלי של קלוד לפי חוק הבינה המלאכותית של האיחוד האירופי. הסימן חי בבחירת הטוקנים ולא במטא-דאטה, וכך פועל הזיהוי.

ב-11 באוגוסט 2026 אישרה Anthropic שקלוד יתחיל להטביע סימני מים קריאים למכונה בטקסט שהוא מייצר. סעיף 50 לחוק הבינה המלאכותית של האיחוד האירופי, המחייב ספקים לסמן פלט שהוא טקסט, תמונה, אודיו או וידאו סינתטי, נכנס לתוקף תשעה ימים קודם לכן — ב-2 באוגוסט.

סימן מים בטקסט אינו לוגו ולא תג במטא-דאטה. הוא פועל ברמת הטוקנים, בתוך המודל, ברגע בחירת המילים. לא מוסיפים דבר לטקסט ולא מסתירים תווים, כך שהסימן נשאר בלתי נראה לקוראים ובלתי מזוהה בלי מפתח קריפטוגרפי תואם.

למה זה קורה עכשיו

סעיף 50(2) חל על ספקים הפועלים בשוק האיחוד האירופי, והעיצומים מגיעים ל-15 מיליון אירו או 3% מהמחזור השנתי העולמי. ביולי 2026 חתמו כ-190 ארגונים — בהם Anthropic, ‏Google, ‏OpenAI, ‏Meta ו-Microsoft — על קוד ההתנהגות של האיחוד לשקיפות תוכן שנוצר ב-AI; מודלים שהיו בשוק לפני 2 באוגוסט צריכים להתיישר עד 2 בדצמבר 2026.

הכיסוי אינו אחיד. SynthID-Text פועל בתוך Gemini מאז 2024. Anthropic מסמנת מודלי קלוד שהושקו ב-2 באוגוסט 2026 ואילך, ואילו OpenAI, שמסמנת תמונות ואודיו בסימני מקור כמו מטא-דאטה C2PA, מתקדמת לאט יותר בטקסט; Meta מסמנת תמונות בלבד.

מה פירוש ברמת הטוקנים

טוקן אינו תמיד מילה שלמה; הוא יכול להיות שבר מילה, סימן פיסוק או אפילו רווח. בכל צעד המודל בונה התפלגות הסתברות לטוקנים הבאים ודוגם ממנה בעזרת מחולל מספרים אקראיים שרירותי — ולכן אותו פרומפט יכול להניב תשובות שונות.

סימן המים משנה את מקור האקראיות: מפתח קריפטוגרפי סודי, יחד עם הטוקנים הקודמים, קובע איזה מועמד ייבחר. הקורא עדיין רואה בחירה אקראית לכאורה, אבל מי שמחזיק באותו מפתח יכול לבדוק אם רצף הבחירות עקבי סטטיסטית עם מה שהמפתח היה מפיק. סימן המים של קלוד הוא גרסה של SynthID-Text, שפרסמה Google DeepMind ב-Nature באוקטובר 2024; מועמדים נמדדים בפונקציות פסאודו-אקראיות ומתחרים בסיבובים, והזיהוי מריץ מחדש את הניקוד.

האם זה פוגע בקוד ובכתיבה טכנית

פחות מכפי שנהוג לחשוב. כמות האות בטוקן פרופורציונלית למספר האפשרויות הכמעט-שוות באותה נקודה. כשקיים טוקן המשך נכון בבירור — "2 + 2 =" ואחריו "4", או שורת קוד שבה רק טוקן אחד שומר על התחביר — אין על מה להשפיע, ולכן הסימן לא מוחל. Anthropic מציינת שקוד נושא בדרך כלל פחות אות סימן מים מפרוזה, והניסוי של גוגל על 20 מיליון תשובות לא מצא הבדל מובהק בשביעות רצון המשתמשים.

פשרות נשארות: בקטעים קצרים ובטקסט עובדתי מאוד הזיהוי חלש, ופרפרזה, שכתוב או תרגום כבדים יכולים למחוק את האות — עריכה קלה בדרך כלל לא. אם אתם קוראים היום ל-API של קלוד או Gemini, חלק מהפלט מסומן וחלק לא, בהתאם למודל ולתאריך ההשקה, ולטקסט מ-OpenAI אין סימן מים מאושר. אם הצינור שלכם מפרפרז פלט של מודל, זכרו שהצעד הזה מחליש את הסימן, וזה משנה אם חובות התאימות שלכם תלויות בהישרדותו בהמשך.

SSiTech

SiTech — פיתוח אתרים בכוח ה-AI

אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.