ב-OpenAI מודים: אנחנו עוצרים את פיתוח מודלי הענק שלנו אחרי שורת תקריות חמורות
המודלים של OpenAI לא מפסיקים לברוח, ואחרי כמה מקרים מביכים חדשים - החברה עוצרת את האימון של המודלים
צילום מסך
תקרית Hugging Face הייתה רק ההתחלה. OpenAI לא מפסיקה לחשוף עוד ועוד מקרים שבהם המודלים שלה ברחו לעולם האמיתי ועשו ככל העולה על רוחם. בסוף השבוע היא חשפה שהתקריות הבלתי נגמרות האלו הובילו גם להשלכה משמעותית על ההתקדמות שלה בקרב על ההובלה בתחום ה-AI.
התקריות לא עוצרות, אבל החברה כן
OpenAI חשפה בסוף השבוע עוד מקבץ של מקרים שבהם סוכנים סוררים של החברה יצאו לעולם האמיתי וייצרו לה עוד כאבי ראש, כולל מקרה אחד שבו 53 תמונות משיחות של משתמשים עם ChatGPT הועלו גם לאתר חיצוני לאחסון תמונות. OpenAI מדגישה כי התמונות הועלו לאתר עם לינקים שאינם פומביים, אך כלי תקשורת אמריקאיים מדווחים כי התמונות עדיין היו ניתנות לגילוי על ידי משתמשים רנדומליים. חשוב לציין כי OpenAI לא מסרה בהודעה שלה אם התמונות שהודלפו על ידי סוכני החברה היו תמונות שמשתמשים העלו לשיחות עם ChatGPT, אם מדובר בתמונות שג'ונרטו על ידי הכלי ואם הן כוללות מידע רגיש או בני אדם שניתן לזהות.
במקרה אחר שחשפה החברה, ומתקשר לחשיפה של ראש ממשלת אוסטרליה מהשבוע שעבר, מתברר שסוכני ה-AI של OpenAI ניגשו לאתרים של סוכנויות ממשל אמריקאיות. על פי ההודעה של OpenAI, במקרה אחד ניסו הסוכנים שלה לפרוץ לאתר של משרד החינוך האמריקאי, כאשר בשני מקרים נוספים הסוכנים ויתרו על הניסיון לפרוץ לאתרים הממשלתיים אבל כן אספו מידע משני אתרים: אתר הרשות לניירות ערך האמריקאית (SEC) ואתר לשכת מפקד האוכלוסין של ארצות הברית. כאמור, המקרים הללו מתחברים למקרה שחשף בשבוע שעבר אנתוני אלבניזי – ראש ממשלת אוסטרליה – ובו פרצו הסוכנים של OpenAI לאתר של מערכת הבריאות האוסטרלית.
כל המקרים הללו הובילו, בסופו של דבר, להחלטה משמעותית מצידה של OpenAI וכזו שיכולה לעלות לה לא מעט בהמשך: היא עוצרת את הפיתוח של המודלים העוצמתיים ביותר שלה (שמכונים גם State of the art, או SOTA). על פי ההודעה של החברה, ההחלטה להפסיק את האימון של המודלים הגיעה לפני שבוע בדיוק, ב-20 בספטמבר, כאשר מודל בתהליך אימון הצליח לנצל פרצה כדי לקבל גישה לרשת. מאז, ונכון ליום שישי האחרון כשחשפה החברה את המהלך, הוקפאו "כל תהליכי האימון, הבחינה וה-inference הכולל שימוש בכלים על ידי המודלים". עם ההודעה על הקפאת אימון המודלים, OpenAI לא מסרה מתי היא מתכננת חזרה לשגרה אך מסרה כי זה יקרה "כשנהיה בטוחים ששיפרנו מספיק את מערכי ההגנה והתנהגות המודלים".
עשרות אלפי מקרים בבחינה
לצד ההודעה של OpenAI מסוף השבוע, הלילה (א') נחשף באתר Axios כי החברה של סם אלטמן, כמו גם Anthropic וחוקרי אבטחה נוספים חוקרים כולם עשרות אלפי מקרים שבהם סוכני AI סוררים ניסו לעקוף סביבות בדיקה ולצאת לעולם האמיתי. על פי הדיווח, המבוסס על מקורות המעורים בבדיקות הללו, החברות בוחנות מקרים שבהם סוכנים ברחו מסביבות סגורות (sandbox), השתלטו על אתרים, ומקרים שבהם ניסו לעקוף כלים שנועדו לבחון אותם. בדיווח מצוין כי המקרים שנבחנים לא כוללים רק הצלחת סוכנים ביציאה לעולם האמיתי, אלא גם מקרים שבהם הסוכנים ניסו לצאת אך לא הצליחו. כל זאת מתרחש כמובן על רקע הקריאות של מנכ"לי ענקיות ה-AI להאט את תהליכי הפיתוח של AI לצורכי בקרה – מה שלא מפריע לאף אחת מהן להמשיך עם השקות של מודלים וכלים חדשים.
KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.