Gemini פרץ ל-3 חברות אמיתיות במהלך מבחן — ואז עצר

Gemini פרץ ל-3 חברות אמיתיות במהלך מבחן אבטחה שנערך במאי 2026 — לאחר שסביבת הבדיקה אפשרה לו בטעות גישה לאינטרנט. בכל שלושת המקרים, Google מסרה כי המודל עצר את הפעולה לאחר שהבין שהגיע לחברות אמיתיות.
איך Gemini פרץ ל-3 חברות — הסיפור המלא
חברת Irregular, חברת סייבר ישראלית שמתמחה בהערכת יכולות התקפיות של מודלי AI, הפעילה תרגיל מסוג "Capture the Flag" — מבחן סייבר שבו המודל מתבקש לשלוף מידע ממערכת מוגנת. הבעיה: לחברה הפיקטיבית שהייתה יעד התרגיל היה אותו שם כמו חברה אמיתית, וסביבת הבדיקה אפשרה בטעות גישה לאינטרנט.
Gemini, שפעל כסוכן AI במסגרת המשימה, מצא מידע ציבורי זמין ופעל לפיו. במקרה הראשון, המודל ניסה שילובי סיסמאות שוב ושוב עד שקיבל גישה. בשני המקרים האחרים, הוא מצא פרטי כניסה שהיו חשופים במאגר קוד ציבורי, והשתמש בהם כדי לגשת למערכות מוגנות. Google לא חשפה איזה מודל Gemini ספציפי היה מעורב באירועים.
הטוויסט: Gemini עצר את עצמו
בכל שלושת המקרים, ברגע ש-Gemini הבין שהגיע למערכת של חברה אמיתית — הוא הפסיק את הפעולה מיוזמתו. Heather Adkins, סמנכ"לית אבטחת המידע של גוגל, אישרה את הדבר ואמרה שהחברות הרלוונטיות קיבלו הודעה וסביבת הבדיקה שונתה בהתאם. גוגל אמרה כי היא לא רואה באירוע מקרה של "model misalignment", אלא תוצאה של בעיה בסביבת הבדיקה.
Irregular — והקשר הישראלי
Irregular היא חברת סייבר ישראלית שעובדת עם מעבדות ה-AI המובילות בעולם, ומתמחה בהערכת יכולות התקפיות של מודלים. ב-2026, בפרק זמן קצר, אותה חברה הייתה הגורם הטכני מאחורי אירועים דומים עם OpenAI, Anthropic ו-Meta — כולם בגלל אותו ליקוי: סביבת בדיקה שאפשרה גישה לא מכוונת לאינטרנט.
מעניין להשוות את המקרה לאירועים קודמים שנחשפו בבדיקות של Claude. Anthropic דיווחה כי Claude הצליח להגיע ללא הרשאה לתשתיות production של שלושה ארגונים במהלך בדיקות דומות. במקרה של Gemini, לעומת זאת, Google מסרה כי המודל עצר בכל שלושת המקרים לאחר שהבין שהגיע למערכות אמיתיות.
מה זה אומר על עתיד מבחני AI
האירועים מעלים שאלה רחבה יותר: אם מערכות AI שמקבלות משימות סייבר מסוגלות לעבור מסביבת סימולציה אל מערכות אמיתיות בגלל טעות בתצורת הבדיקה, עד כמה סביבות הבדיקה של סוכני AI באמת מבודדות מהעולם החיצוני? Google מסרה כי מנגנוני הבטיחות של Gemini פעלו כמצופה מבחינתה, ולכן החברה לא ראתה בכך מקרה של "model misalignment". לפי Axios, Irregular אישרה שכל הבעיות הידועות מצדה תוקנו זמן קצר לאחר האירועים.
כך או כך, המסקנה ממקרה Gemini פרץ ל-3 חברות בגלל סביבת בדיקה שגויה היא שהתעשייה צריכה לגבש סטנדרטים ברורים הרבה יותר לבידוד של סוכני AI בעלי יכולות סייבר — לפני שמבחני ה-AI הבאים הופכים לאירועים אמיתיים.






