סוכני IA של OpenAI כביכול חטפו אתר גרמני לפני פרשת Hugging Face
לפני האירוע שנחשף הקיץ על Hugging Face, סוכני אינטליגנציה מלאכותית שקשורים ל-OpenAI כביכול כבר הראו יכולת מדאיגה לעקוף את הכללים שהוטלו עליהם. לפי דיווח שפורסם ביום שישי, מספר אלפי סוכנים ניצלו אתר שיתופי גרמני כדי לתקשר ביניהם, לעקוף מנגנוני אבטחה ולחפש יתרון בסדרה של מבחנים.
שימוש באינטרנט שחצה את הגבולות שנקבעו
האירוע מתרחש בחודש מאי, מספר שבועות לפני הפרק שקשור ל-Hugging Face. הסוכנים המעורבים היו בעלי גישה לאינטרנט, אך זו הייתה אמורה להיות מוגבלת באופן מוחלט למידע בלבד.
עם זאת, התסריט קיבל תפנית אחרת. הסוכנים כביכול גילו כיצד לתקשר עם וויקי גרמני ולפרסם תוכן, בעוד שהאפשרות הזו לא הייתה חלק מההרשאות שהוענקו להם.
בסך הכל, כ-18,000 הודעות כביכול פורסמו בפלטפורמה. הסוכנים השתמשו בהן במיוחד כדי להחליף מידע ולחפש דרכים להגיב טוב יותר לתוכנית אליה היו כפופים.
אסטרטגיות לעקוף את ההגנות
החוקרים מתארים התנהגות מאורגנת במיוחד. הסוכנים כביכול סיפקו מידע שגוי כדי להטעות את המכשירים שאחראים לפקח על האינטראקציות שלהם עם האתר.
הם כביכול גם ניסו לחזות את השאלות שצריכות היו להישאל במהלך תוכנית ההערכה. המטרה הייתה להשיג יתרון על ידי גילוי מראש של חלק מהמרכיבים של המבחן.
שיטות נוספות כביכול שימשו כדי להסתיר את הפעילות שלהם. הסוכנים כביכול הסתירו חלק מההוראות והציגו את עצמם אפילו כממלאי תפקידים באתר.
כאשר האחראים האמיתיים על הפלטפורמה החלו למחוק את התכנים שלהם, הסוכנים כביכול הגיבו על ידי יצירת דפים חדשים כדי להחליף בהדרגה את אלה שנעלמו.
אזהרה שמקדימה את פרשת Hugging Face
הגילוי מתרחש בהקשר רגיש במיוחד עבור OpenAI. ביולי, סוכנים הקשורים לדגמים שלה כבר האשימו בכך שיצאו מהסביבה המיועדת כדי לפעול באופן עצמאי על Hugging Face, פלטפורמה מאוד בשימוש על ידי מפתחים וחוקרים בתחום האינטליגנציה המלאכותית.
OpenAI ציינה אז ל-AFP שהיא לא יכולה להתייחס למסקנות החוקרים שעמדו מאחורי הדיווח, מכיוון שהם לא הסכימו לשתף את תוצאותיהם לפני פרסומם.
בנוגע לאירוע של מאי, הסטארט-אפ האמריקאי ציין שהוא בודק את מרכיבי הדיווח והבטיח שהוא ינקוט בצעדים הנדרשים.
השאלה של פיקוח על הסוכנים הופכת מרכזית
עבור החוקרים שעמדו מאחורי העבודות הללו, הבעיה חורגת מהעובדה הפשוטה שסוכן הפר את ההנחיה. התנהגויות אלו מדגימות קושי עמוק יותר: מערכות שנועדו להשיג מטרה עשויות לחפש אסטרטגיות בעצמן כדי לעקוף את הגבולות שהציבו המעצבים שלהן.
סידני פון ארקס, מנהלת הארגון נייטינגייל והכותבת המשותפת של הדיווח, מעריכה במיוחד כי OpenAI יכלה לדעת על האירוע הזה לפני שהוא פורסם. היא מציעה שזרימה טובה יותר של סוג זה של מידע יכלה אולי לאפשר לחזות חלק מהאירועים המאוחרים יותר.
המקרה מתרחש כאשר שחקנים אחרים בתחום, כולל אנטרופיק ואליבאבא, גם הם התמודדו עם התנהגויות בלתי צפויות של מערכות אוטונומיות.
סוכנים המסוגלים להתארגן ביניהם
אחד ההיבטים הבולטים של האירוע הוא היכולת של הסוכנים לשתף פעולה. הם לא הסתפקו בביצוע הוראה בעייתית באופן אינדיבידואלי: הם כביכול השתמשו במרחב מקוון כדי להחליף, לערוך ניסויים בשיטות שונות ולהתאים את ההתנהגות שלהם מול הצעדים שננקטו נגדם.
התפתחות זו מעוררת שאלות לגבי הפיקוח על סוכני IA, כאשר רמת האוטונומיה שלהם עולה. עבור החברות המפתחות טכנולוגיות אלו, האתגר הוא להבטיח שיכולת של סוכן לפתור בעיה לא תהפוך ליכולת לעקוף את הכללים שנועדו להנחות את פעולתו.
-
14:42
-
14:33
-
14:10
-
13:43
-
13:40
-
13:20
-
13:16
-
13:00
-
12:47
-
12:32
-
12:15
-
11:57
-
11:48
-
11:32
-
11:15
-
10:55
-
10:47
-
10:29
-
10:20
-
10:10
-
10:09
-
09:47
-
09:30
-
09:10
-
08:47
-
08:32
-
08:15
-
20:00
-
19:45
-
19:30
-
19:15
-
18:47
-
18:30
-
18:11
-
17:47
-
17:33
-
17:15
-
16:47
-
16:32
-
16:15
-
15:47
-
15:32