סימן מים ChatGPT: הטקסט יסומן באירופה בלי שתראו

בשבועות הקרובים, טקסטים שיופקו באמצעות ChatGPT ו-Codex באיחוד האירופי יישאו סימן מים ChatGPT שאי אפשר לראות בעין. OpenAI הודיעה על המהלך ב-5 באוקטובר, וקראה למערכת textGrain. הסימון יופעל בכל התוכניות, כולל החינמית, ונועד לעמוד בדרישות השקיפות של חוק ה-AI האירופי.
איך עובד סימן מים ChatGPT שלא רואים
אין כאן תו נסתר, אימוג'י או שורה בתחתית התשובה. לפי OpenAI, המערכת משתמשת במפתח סודי כדי להטות בעדינות את בחירת המילים של המודל, וכך נוצר דפוס סטטיסטי שגלאי ייעודי יודע לזהות. מבחינת הקורא, התשובה נראית רגילה לחלוטין. ההבדל מהותי: מאחר שהסימון "שזור" במילים עצמן, הוא נשאר גם כשמעתיקים את הטקסט ומדביקים אותו במסמך, במייל או בעבודה להגשה.
איפה הסימון נשבר
כאן מתחיל החלק המעניין. לפי הדו"ח הטכני של OpenAI, החלפה של עשרה אחוזים מהמילים במילים נרדפות הורידה את שיעור הזיהוי לכשני שלישים בלבד, וכשרבע מהמילים הוחלפו הוא צנח לכ-17 אחוזים. גם טקסטים קצרים ותוכן מתמטי קשים יותר לזיהוי. החברה עדיין בודקת איך תרגום ועריכה משפיעים על עמידות הסימון.
OpenAI עצמה מדגישה שני דברים: היעדר סימן לא מוכיח שאדם כתב את הטקסט, וזיהוי של סימן לא חושף מי כתב, מאיזה חשבון או באיזו שיחה. גם הגלאי לא פתוח לציבור, ובשלב הראשון רק חוקרים וגופים מתמחים שיאושרו יקבלו אליו גישה. כלומר, בשלב הראשון מורה או מעסיק לא יוכלו פשוט להדביק טקסט בגלאי הרשמי של OpenAI ולבדוק אותו. מי שרוצה להבין מתי בכל זאת לא לסמוך על טקסט של בינה מלאכותית, יכול לקרוא את המדריך שלנו איך לזהות מידע שגוי מ-AI.
ומה עם משתמשים בישראל?
לפי התוכנית שפורסמה, בשלב ההשקה משתמשים מחוץ לאיחוד האירופי לא יקבלו טקסט מסומן ב-ChatGPT וב-Codex כברירת מחדל, כך שבשלב זה סימן מים ChatGPT לא אמור לחול על משתמשים בישראל. מפתחים שעובדים עם ה-API יכולים להפעיל את הסימון מרצונם בכל העולם החל מ-5 באוקטובר.
התמונה שונה אצל המתחרה: Anthropic כבר מטמיעה סימן מים בלתי נראה בטקסט של מודלי Claude שהושקו מאז 2 באוגוסט, ולפי החברה הוא חל בכל העולם ולא רק באירופה. במילים אחרות, דווקא מי שכותב עם Claude בישראל כבר עשוי לקבל טקסט מסומן.
הרקע לכל זה הוא סעיף 50 בחוק ה-AI האירופי, שחובות השקיפות שלו נכנסו לתוקף באוגוסט ומחייבות לסמן תוכן שנוצר בבינה מלאכותית בצורה שמכונה יכולה לקרוא. OpenAI מתכננת לשחרר את textGrain כקוד פתוח, ולפי דיווח ב-BleepingComputer החברה מודה בעצמה שעריכה יכולה להעלים את הסימון.






