OpenAI מכינה סימון בלתי נראה לטקסטים שנוצרו על ידי AI באיחוד האירופי
OpenAI מכינה להשיק מערכת חדשה שיכולה להפוך חלק מהטקסטים המיוצרים באמצעות ChatGPT ו-Codex לזיהוי טכני מבלי לשנות את האופן שבו הם מופיעים לקוראים. החברה אומרת שהטכנולוגיה, הידועה בשם textGrain, תושק בהדרגה למשתמשים זכאים באיחוד האירופי במהלך השבועות הקרובים.
היוזמה מגיעה כאשר כללים אירופיים שמים דגש הולך ומתרקם על שקיפות סביב תוכן שנוצר או מעובד באמצעות אינטליגנציה מלאכותית. במקום להציג תווית נראית, הגישה של OpenAI משובצת סיגנל סטטיסטי ישירות בטקסט שנוצר, מה שמאפשר למערכות זיהוי מיוחדות לחפש ראיות למקורו.
עבור קוראים רגילים, ההבדל אמור להיות בלתי מורגש. לא תהיה אזהרה, אייקון או הצהרה מפורשת המצורפת לטקסט המצביעה על כך שמודל AI היה מעורב.
איך textGrain משבץ את הסיגנל שלו
בניגוד לטכניקות סימון קונבנציונליות שתלויות בתווים מוסתרים או ברווחים בלתי נראים, textGrain פועל במהלך תהליך הגנרציה של המודל. המערכת משפיעה בעדינות על כמה בחירות מילים, יוצרת דפוס שנשאר טבעי לקורא אנושי אך עשוי להיות מזוהה על ידי גלאי תואם.
עיצוב זה מיועד להפוך את הסיגנל לעמיד יותר בפני העתקה והדבקה בסיסית. עם זאת, הטכנולוגיה לא מיועדת לספק היסטוריה מלאה של מסמך.
זיהוי מוצלח יצביע על כך שהטקסט נוצר או עובד באמצעות מערכת OpenAI תואמת. זה לא יחשוף את זהות המשתמש, לא יחשוף את הפקודה שהוגשה למודל ולא יקבע בדיוק כמה מהטקסט הסופי נערך לאחר מכן על ידי אדם.
שכתוב נשאר אתגר מרכזי
האמינות של זיהוי טקסטים שנוצרו על ידי AI נשארת קשורה מאוד לכמות החומר הזמין ולמידת השינוי בניסוח המקורי.
על פי בדיקות שדיווחו OpenAI, הזיהוי הגיע לכ-92% בתנאים מסוימים עבור קטעים של כ-400 טוקנים. הביצועים ירדו לכ-66% לאחר שהוחלפו כ-10% מהמילים עם נרדפות, וירדו לכ-17% כאשר היחס הגיע ל-25%.
תרגום ועריכה משמעותית על ידי בני אדם יכולים גם להחליש את הדפוס הניתן לזיהוי. משמעות הדבר היא שכישלון בזיהוי הסימון לא יכול, בעצמו, להוכיח שטקסט נכתב כולו על ידי אדם.
OpenAI גם מכירה באפשרות של תוצאות חיוביות שקריות, מגבלה חשובה עבור מוסדות שעשויים לשקול להשתמש בזיהוי אוטומטי כאשר הם מעריכים חומר כתוב אקדמי, מקצועי או אחר.
חוקרים יקבלו גישה בתחילה
הטכנולוגיה עצמה לזיהוי לא צפויה להיות זמינה מיד לכולם. OpenAI מתכננת לספק גישה בתחילה לחוקרים נבחרים ולארגונים מיוחדים כך שהמערכת תוכל לעבור בדיקות נוספות והערכה.
החברה גם שוקלת יישומים רחבים יותר מעבר להשקה האירופית. לקוחות מסוימים של OpenAI API יוכלו להפעיל את הפיצ'ר על מודלים תואמים, אם כי הוא יישאר כבוי כברירת מחדל.
OpenAI גם ציינה שהיא מתכוונת לשחרר את textGrain כטכנולוגיה בקוד פתוח. מהלך כזה יכול לאפשר לחוקרים ולמפתחים עצמאיים לבדוק את הגישה, לבחון את עמידותה ולחקור יישומים חדשים למעקב אחר תוכן שנוצר על ידי AI.
שכבת חדשה במסגרת השקיפות של AI באירופה
הפריסה של textGrain מדגימה שינוי רחב יותר בדרך שבה חומר שנוצר על ידי AI מטופל באיחוד האירופי. ככל שה-AI הגנרטיבי משתלב יותר ויותר בחינוך, בעסקים, במדיה ובשירותים ציבוריים, מחוקקים וחברות טכנולוגיה מחפשים מנגנונים שיכולים להבחין בין תוכן שנוצר על ידי מכונה לכתיבה אנושית קונבנציונלית.
המערכת של OpenAI לא מציעה תשובה מוחלטת לאתגר הזה. היעילות שלה יכולה לרדת באופן חד כאשר הטקסט קצר, מתורגם או שכתוב באופן משמעותי, בעוד שגיאות זיהוי נותרות אפשריות.
עם זאת, הטכנולוגיה מייצגת ניסיון להעביר את שקיפות ה-AI מעבר לתוויות נראות לעין ולכיוונים טכניים המשובצים ישירות בתוכן שנוצר. אם יאומצו בהיקף נרחב, מערכות כמו textGrain עשויות להפוך לחלק מהתשתית המתפתחת המשמשת להעריך את מקור הטקסט הדיגיטלי.
-
21:00
-
20:32
-
20:15
-
20:00
-
19:40
-
19:19
-
19:00
-
18:35
-
18:15
-
18:00
-
17:30
-
17:15
-
16:50
-
16:33
-
16:16
-
16:00
-
15:42
-
15:25
-
15:10
-
14:47
-
14:32
-
14:15
-
14:00
-
13:40
-
13:20
-
13:05
-
12:45
-
12:30
-
12:12
-
11:47
-
11:32
-
11:15
-
11:00
-
10:42
-
10:25
-
10:10
-
10:10
-
09:47
-
09:30
-
23:50
-
23:32
-
23:15
-
22:50