גם OpenAI תלשין שכתבתם את הטקסט עם AI והיא מסבירה איך
אחרי ש-Anthropic עשתה את זה עם Claude, ב-OpenAI מסבירים כיצד יגרמו ל-ChatGPT לייצר טקסטים שניתן לזהות שג'ונרטו על ידי AI

צילום מסך. עיבוד תמונה: גיקטיים
יש לא מעט דרכים שאיתן אתם יכולים לנסות לזהות טקסט שנכתב עם AI. קולגה שבקושי כותבת לכם משפטים שלמים ופתאום שולחת לכם איגרת ברכה ארוכה ביום ההולדת ב-Slack, מקפי ה-em dash הארוכים, תבניות חוזרות, שימוש באימוג'ים וכמובן הקלאסיקה של אנשים שמעתיקים את כל הטקסט כולל את "תרצה שאנסח לך גם גרסה קצרה יותר?". אבל מעבר לזה? לא תמיד אפשר לדעת שטקסט כלשהו ג'ונרט בעזרת LLM's.
עכשיו, ובעקבות דרישות של האיחוד האירופי, יהיה ניתן לדעת האם טקסט כלשהו ג'ונרט על ידי ChatGPT.
הכל תלוי בבחירת המילים
אחרי ש-Anthropic כבר נקטה בצעד דומה ואף חשפה איך היא תעשה את זה בפועל, הגיע תורה של OpenAI להיענות לדרישות השקיפות של חוק הבינה המלאכותית החדש באירופה. החוק מחייב את ספקיות ה-AI השונות לאפשר זיהוי של טקסט מג'ונרט באמצעות כלים שונים.
ב-OpenAI מציינים שמערכת ה-Watermarking שלהם עדיין בשלבי פיתוח, אך הם כבר מחויבים להציג פתרון. במסגרת זו, בשבועות הקרובים משתמשים באיחוד האירופי יקבלו תוספת של "סימני המים" הבלתי נראים האלו בטקסטים שיג'ונרטו ב-ChatGPT וב-Codex. במקביל, החל מעכשיו משתמשי ה-API של ChatGPT יכולים להוסיף את אותם Watermarks לטקסטים המג'ונרטים על ידי חלק מהמודלים – מה שאומר שגם טקסטים שיג'ונרטו לכם על ידי כלים צד-ג' ילשינו עליכם, אם כי האפשרות הזו תהיה כבויה כברירת מחדל. במילים אחרות, גם אם תשתמשו באפליקציה חיצונית, שמתחת למכסה המנוע עושה שימוש ב-API של OpenAI, הטקסט יוכל להסגיר שכתבתם אותו בעזרת AI.
כדי להשלים את המהלך, החברה פותחת כעת את ההרשמה לגישה מוקדמת לכלי זיהוי ה-Watermarks שלה, כאשר בשלב הראשון תינתן גישה מוגבלת לחוקרים ומומחים בתחום שיסייעו בשיפור הכלי.
אותות בלתי נראים
אז איך כל ה-Watermarks האלה עובדים בפועל? לפי OpenAI, החברה תשתמש בטכנולוגיה בשם textGrain שמוסיפה "אותות סטטיסטיים בלתי נראים", כך שהמודל יבחר מילים שבסופו של דבר יאפשרו זיהוי של טקסט מג'ונרט על ידי כלי הזיהוי של החברה. ב-OpenAI טוענים כי textGrain עובד באופן דומה לגישות אחרות שנבחנו, ובהן גם השימוש ב-SynthID לטקסטים של גוגל. על קצה המזלג, textGrain משתמש בסוג של מפתח סודי שגורם לו להעדיף ולבחור מילים מסוימות על פני מילים אחרות כאשר ChatGPT מג'נרט טקסט. המילים הללו יוצרות תבניות סטטיסטיות נסתרות שעין אנושית לא תזהה – כי הטקסט עדיין נראה טבעי – אבל המילים שבהן המודל בחר יסגירו לכלי הזיהוי את העובדה שמדובר בטקסט מג'ונרט.
תמונה: Dreamstime
ולמרות השיטה החדשה שלטענתם היא הטובה בשוק, ב-OpenAI מבהירים כי הדבר לא מבטיח זיהוי מוחלט ועקבי. כך למשל, בתוכן מעולם הפסיכולוגיה, כלי הזיהוי הצליח למצוא את ה-Watermarks בכ-80% מהפסקאות שהשתמשו ב-200 טוקנים, בהשוואה ל-95% זיהוי בפסקאות ארוכות יותר של 400 טוקנים. בטקסט שעוסק במתמטיקה, לעומת זאת, יש למודלים פחות גמישות בבחירת המילים, והכלי של OpenAI הגיע לנתוני זיהוי נמוכים יותר. בנוסף, אי אפשר לשכוח שאת הטקסטים ש-ChatGPT מייצר אפשר פשוט לערוך. ברגע שמשתמש החליף 10% מהמילים שנבחרו על ידי המודל במילים נרדפות, שיעור הזיהוי צנח מ-92% ל-66%. כשהמשתמש החליף 25% מהמילים, אחוז הזיהוי התרסק ל-17%.
בינתיים נראה ש-OpenAI מחויבת להציג את הטכנולוגיה הזו רק באיחוד האירופי, אך לא מן הנמנע שבהמשך רגולטורים נוספים יגיעו עם דרישות דומות. בחברה מדגישים כי השימוש באיחוד האירופי יאפשר להם לשפר את המנגנונים ולקבל החלטות בהמשך. אז לפחות נכון לעכשיו, אם אתם בישראל, אתם עדיין יכולים לג'נרט לכולם ברכות ללא חשש.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.