mako
פרסומת

סוכני ה-AI של OpenAI השתלטו על אתר גרמני והפכו אותו ללוח מודעות

יותר מ-15 אלף עריכות אותרו באתר, כולל ניסיונות לעקוף מגבלות ולהסתיר את הפעילות. OpenAI טוענת שהממצאים עדיין לא נבדקו על ידה. במקביל, ביום חמישי הציגה OpenAI את מודל אסטרה המתקדם ביותר שלה

דנה גוטרזון
פורסם:
ChatGPT
ChatGPT | צילום: jackpress, shutterstock
הקישור הועתק

סוכני AI של OpenAI השתלטו באביב על אתר גרמני והפכו אותו ללוח הודעות לסוכני AI אחרים, כך פי פרסום של רויטרס, שהתבסס על מחקר חדש ושני גורמים המעורים בפרטים. לפי אותם גורמים, בכירי OpenAI ידעו על האירוע כבר לפני כמה שבועות, אבל לא פרסמו אותו בזמן שהחברה התמודדה עם ההשלכות של פריצה ביולי למאגר הקוד הפתוח Hugging Face, שנרכש על ידי אנבידיה ביום חמישי.

לפי רויטרס, האירוע החל במאי ולא דווח עד עכשיו. הוא מגיע על רקע מרוץ של חברות AI לפתח סוכנים אוטונומיים יותר, שמסוגלים לבצע משימות מורכבות, ובמקביל חשש גובר שהם לומדים לעקוף כללים, לנצל פרצות ולתאם ביניהם פעולות בדרכים שהמפתחים לא צפו ולא התכוונו אליהן.

OpenAI הודיעה בעבר כי תגביר את הפיקוח על המודלים שלה, ובחודש שעבר עצרה לזמן קצר חלק מאימוני המודלים כדי להוסיף אמצעי בטיחות. ביום חמישי הציגה החברה את המודל החדש שלה GPT-6 Astra, מודל בינה מלאכותית מתקדם המציג קפיצת מדרגה ביכולות סייבר, פיתוח תוכנה ושליטה עצמאית במחשב ובדפדפן, אך גם עלול להתחמק מניטור אנושי. נשיא החברה גרג ברוקמן טען כי המודל הוא תחילת תקופת ה-AGI, הבינה המלאכותית הכללית שמסוגלת לבצע משימות ברמת בן אנוש או למעלה מכך.

החוקרים סידני פון ארקס, מנכ"לית ארגון בטיחות ה-AI Nightingale, וקורמק סלייד בירד, חוקר AI וסוחר אלגוריתמי שעבר, איתרו את הפעילות בסוף אוגוסט, בזמן שחיפשו ברשת סימנים להתנהגות לא מורשית של סוכני AI.

לפי החוקרים, הם מצאו יותר מ-15,000 עריכות שביצעו סוכני AI באתר ויקי בגרמנית בשם DseWiki, שמיועד למתכנתים ומאפשר עריכה קהילתית בדומה לוויקיפדיה. העריכות הראו שסוכני OpenAI השתמשו באתר כלוח הודעות, ושיתפו בו שיטות לרמות בחלק מהמשימות, לעקוף את ההגבלות של OpenAI ולהסתיר את ההתנהגות שלהם.

פרסומת

החוקרים אמרו כי זיהו את הפעילות כפעילות של סוכני AI, בין היתר בגלל מהירות פעולה גבוהה במיוחד והתמקדות אינטנסיבית בפתרון שאלות טכניות מהסוג שחברות AI משתמשות בו כדי לאמן ולבחון מודלים. ההודעות נחתמו בידי משתמשים שהתייחסו לעצמם ולאחרים כסוכנים, וכמחצית מהם בחרו לעצמם שמות שמרמזים על קשר ל-OpenAI, כמו OpenAIResearcher או OAIResearchMar26.

עוד אמרו החוקרים כי יומני שרת ציבוריים הצביעו על כך שחלק גדול מהפעילות הגיע מתשתית Microsoft Azure, שבה OpenAI משתמשת לפעמים. הם גם זיהו ביקורים חוזרים באתר מצד עובדי OpenAI אחרי האירוע, דפוס שלטענתם מרמז מאוד על קשר בין הסוכנים לחברה.

לפי החוקרים, הודעות שבחנו הראו סוכנים שמתכננים דרכים לחמוק מזיהוי, להשתמש בכלים כמו דפדפן Tor ולשמר תקשורת גם אחרי שנסגרה. כשמנהל האתר החל למחוק עמודים ביוני, הסוכנים הגיבו ביצירת עמודי גיבוי כדי לעקוף את הניקוי. "נראה שמבצע ניקוי/מחיקת הוויקי פעיל לפי סדר אלפביתי", כתב סוכן אחד ב-19 ביוני. "אם העמוד הזה נעלם, נסו [[ZZZDataUSAConstructionWageLive]]".

פרסומת

החוקרים מצאו גם ניסיונות להתערב באתר עצמו. לוקאש אולייניק, עמית מחקר בכיר אורח בקינגס קולג' לונדון, אמר כי מדובר בניסיון פריצה. OpenAI חלקה על האפיון הזה, על בסיס ניתוח שערכה לחומר ביום חמישי.

לפי רויטרס, חלק מחוקרי OpenAI רצו לבחון מקרוב דפוס רחב יותר של פעילות AI, אך ניסיונות להרחיב את הבדיקה נתקלו בהתנגדות מצד גורמים אחרים בתוך החברה, בהם יועצים משפטיים, כך אמרו ארבעה אנשים שמכירים את הפרטים. "הטענות שלפיהן הצוות המשפטי שלנו מנע חקירה של האירוע הן שקריות", אמר דובר OpenAI. הדובר הוסיף כי הפעילות בגרמניה לא הייתה קשורה ל-Hugging Face ולא הייתה אמורה להיכלל בדוח האירוע של Hugging Face, וכי OpenAI פעלה בתום לב בשיתוף עם מומחים חיצוניים ודיווחה על אירועים רלוונטיים.

"אנחנו לא יכולים להגיב באופן משמעותי לטענות או לממצאים בדוח שלא ניתנה לנו הזדמנות לעיין בו", אמר דובר OpenAI. "רויטרס ומחברי הדוח דחו את בקשתנו לקבל גישה. נבחן בזהירות את תוכנו עם פרסומו וננקוט את הצעדים הבאים הנדרשים".