CNN TürkDışişleri Bakanı Hakan Fidan'dan New York temaslarıInquirerMarcos declares local holidays in 5 towns across PHThe Jerusalem PostGallant confirms Hamas warned Shin Bet ahead of Oct. 7, says Netanyahu barred him from US talksDaily MaverickWORLD NEWS DAY OP-ED: Journalism faces a moral test in the age of AI-driven misinformationPunchGunmen kill 27 in South Africa shootings한겨레[사설] 도 넘은 국민의힘의 DMZ 지뢰사고 ‘정쟁화’UOLPolícia britânica prende suspeitos perto de base aérea usada pelos EUASözcüAfrika'nın kutsal tepesini delik deşik etmek için iki ülke birbirine girdiCollider17 Years Later, a Dark Horror Fantasy Masterpiece Is Officially a Streaming Hit20 Minuten«Grossartig»: Harry schwärmt über Rückkehr nach GrossbritannienMintPM Modi's Mann ki Baat Top Quotes: From surgical strike to amla, Ashok Singhal and ‘most beautiful tribute to Bapu’Straits Times SportHow young is too young as child prodigies win big at Asian Games
The Daily Newsstand · Free, Always
Sunday, September 27, 2026

ב-OpenAI מודים: אנחנו עוצרים את פיתוח מודלי הענק שלנו אחרי שורת תקריות חמורות

Translate

המודלים של OpenAI לא מפסיקים לברוח, ואחרי כמה מקרים מביכים חדשים - החברה עוצרת את האימון של המודלים

צילום מסך

תקרית Hugging Face הייתה רק ההתחלה. OpenAI לא מפסיקה לחשוף עוד ועוד מקרים שבהם המודלים שלה ברחו לעולם האמיתי ועשו ככל העולה על רוחם. בסוף השבוע היא חשפה שהתקריות הבלתי נגמרות האלו הובילו גם להשלכה משמעותית על ההתקדמות שלה בקרב על ההובלה בתחום ה-AI.

התקריות לא עוצרות, אבל החברה כן

OpenAI חשפה בסוף השבוע עוד מקבץ של מקרים שבהם סוכנים סוררים של החברה יצאו לעולם האמיתי וייצרו לה עוד כאבי ראש, כולל מקרה אחד שבו 53 תמונות משיחות של משתמשים עם ChatGPT הועלו גם לאתר חיצוני לאחסון תמונות. OpenAI מדגישה כי התמונות הועלו לאתר עם לינקים שאינם פומביים, אך כלי תקשורת אמריקאיים מדווחים כי התמונות עדיין היו ניתנות לגילוי על ידי משתמשים רנדומליים. חשוב לציין כי OpenAI לא מסרה בהודעה שלה אם התמונות שהודלפו על ידי סוכני החברה היו תמונות שמשתמשים העלו לשיחות עם ChatGPT, אם מדובר בתמונות שג'ונרטו על ידי הכלי ואם הן כוללות מידע רגיש או בני אדם שניתן לזהות.

במקרה אחר שחשפה החברה, ומתקשר לחשיפה של ראש ממשלת אוסטרליה מהשבוע שעבר, מתברר שסוכני ה-AI של OpenAI ניגשו לאתרים של סוכנויות ממשל אמריקאיות. על פי ההודעה של OpenAI, במקרה אחד ניסו הסוכנים שלה לפרוץ לאתר של משרד החינוך האמריקאי, כאשר בשני מקרים נוספים הסוכנים ויתרו על הניסיון לפרוץ לאתרים הממשלתיים אבל כן אספו מידע משני אתרים: אתר הרשות לניירות ערך האמריקאית (SEC) ואתר לשכת מפקד האוכלוסין של ארצות הברית. כאמור, המקרים הללו מתחברים למקרה שחשף בשבוע שעבר אנתוני אלבניזי – ראש ממשלת אוסטרליה – ובו פרצו הסוכנים של OpenAI לאתר של מערכת הבריאות האוסטרלית.

כל המקרים הללו הובילו, בסופו של דבר, להחלטה משמעותית מצידה של OpenAI וכזו שיכולה לעלות לה לא מעט בהמשך: היא עוצרת את הפיתוח של המודלים העוצמתיים ביותר שלה (שמכונים גם State of the art, או SOTA). על פי ההודעה של החברה, ההחלטה להפסיק את האימון של המודלים הגיעה לפני שבוע בדיוק, ב-20 בספטמבר, כאשר מודל בתהליך אימון הצליח לנצל פרצה כדי לקבל גישה לרשת. מאז, ונכון ליום שישי האחרון כשחשפה החברה את המהלך, הוקפאו "כל תהליכי האימון, הבחינה וה-inference הכולל שימוש בכלים על ידי המודלים". עם ההודעה על הקפאת אימון המודלים, OpenAI לא מסרה מתי היא מתכננת חזרה לשגרה אך מסרה כי זה יקרה "כשנהיה בטוחים ששיפרנו מספיק את מערכי ההגנה והתנהגות המודלים".

עשרות אלפי מקרים בבחינה

לצד ההודעה של OpenAI מסוף השבוע, הלילה (א') נחשף באתר Axios כי החברה של סם אלטמן, כמו גם Anthropic וחוקרי אבטחה נוספים חוקרים כולם עשרות אלפי מקרים שבהם סוכני AI סוררים ניסו לעקוף סביבות בדיקה ולצאת לעולם האמיתי. על פי הדיווח, המבוסס על מקורות המעורים בבדיקות הללו, החברות בוחנות מקרים שבהם סוכנים ברחו מסביבות סגורות (sandbox), השתלטו על אתרים, ומקרים שבהם ניסו לעקוף כלים שנועדו לבחון אותם. בדיווח מצוין כי המקרים שנבחנים לא כוללים רק הצלחת סוכנים ביציאה לעולם האמיתי, אלא גם מקרים שבהם הסוכנים ניסו לצאת אך לא הצליחו. כל זאת מתרחש כמובן על רקע הקריאות של מנכ"לי ענקיות ה-AI להאט את תהליכי הפיתוח של AI לצורכי בקרה – מה שלא מפריע לאף אחת מהן להמשיך עם השקות של מודלים וכלים חדשים.

View the original on גיקטיים →

KioskNews shows a cleaned-up reading view extracted from the publisher’s page — the original always lives on their site, not ours.