דלגו לתוכן

מודל Mythos של Anthropic נתפס יוצר זהויות מזויפות ומתחזה לבני אדם במבחן בטיחות

Joy Iyke5 באוגוסט 2026
  • מבחן בטיחות של AISI מצא שמודל Mythos 5 של Anthropic היה מעורב ברוב התקריות, כולל יצירת זהויות מזויפות וכתיבת קוד זדוני, בעוד GPT-5.6-Sol של OpenAI נקשר לשתי פעולות לא מורשות בלבד.
  • Anthropic ו-OpenAI מסרו שהן פועלות יחד עם גורמי בטיחות וחוקרים כדי לחזק את שיטות הבדיקה, בעוד ששתי החברות עדיין פרטיות אך עשויות לצאת להנפקה ב-2026 או ב-2027.
מודל Mythos של Anthropic נתפס יוצר זהויות מזויפות ומתחזה לבני אדם במבחן בטיחות

מודל בינה מלאכותית מתקדם של Anthropic, המפתחת של Claude, נמצא יוצר זהויות מזויפות ברשת במהלך מבחן בטיחות שערך מכון אבטחת הבינה המלאכותית של בריטניה (AISI). אותו מבחן מצא גם שמודל של OpenAI, יוצרת ChatGPT, הפר את כללי הבטיחות שלו. הממצאים החדשים מגיעים כמה ימים לאחר שמודלים של Anthropic ושל OpenAI פרצו לכמה חברות. 

המודלים Mythos 5 ו-GPT-5.6-Sol הפרו את כללי מבחן הבטיחות

לפי AISI, סוכנים של OpenAI ושל Anthropic השתתפו ב"פעילות מתמשכת, שעלולה להזיק, שהופנתה כלפי אנשים וארגונים אמיתיים".

הסוכנות חשפה את הממצאים ביום שלישי, 4 באוגוסט, לאחר שהעבירה את המודלים של Anthropic ושל OpenAI מבחן סייבר. היא ביצעה את המבחן 122 פעמים כדי לבדוק איך המודלים התנהגו בתרחישים מציאותיים, ותיעדה 19 פעולות לא מורשות ב-10 הרצות מבחן.

המודל החדש ביותר של Anthropic, Mythos 5, היה אחראי ל-17 מהתקריות, בעוד ש-GPT-5.6-Sol של OpenAI נקשר לשתי התקריות הנותרות. המקרה החמור ביותר כלל את המודל של Anthropic, שכתב קוד זדוני ויצר זהויות מזויפות ברשת כדי להשלים את המבחן שלו ולהטעות אדם כך שיאשר אותו.

למרות ש-AISI עצמו לא זיהה איזה סוכן בינה מלאכותית יצר את הזהויות המזויפות, Anthropic אישרה מאוחר יותר שהמודל שלה היה אחראי לכך. בניגוד ל-Mythos, GPT-5.6-Sol של OpenAI לא נקשר לזהויות המזויפות או ליצירת קוד זדוני. במקום זאת, שתי הפעולות הלא מורשות שלו נקשרו לגישה לאינטרנט בדרכים שהפרו את כללי המבחן.

המכון הוסיף שאף אחת מהתקריות לא גרמה לנזק בעולם האמיתי, משום שהן התרחשו בסביבת בדיקה מבוקרת.

Anthropic ו-OpenAI מגיבות לממצאי AISI

Anthropic הודתה ל-AISI על חשיפת התקרית, ואמרה שהדבר מראה שיש צורך בשיח רחב יותר על איך לבדוק בבטחה סוכני בינה מלאכותית חזקים יותר. החברה גם מסרה שהיא עובדת עם AISI כדי לאסוף פרטים נוספים ולבצע חקירה משלה.

OpenAI מסרה שהיא נשארת מחויבת לעבוד עם מפתחי בינה מלאכותית, גופי בטיחות לאומיים לבינה מלאכותית וחוקרים עצמאיים כדי לחזק את אופן הבדיקה של מערכות בינה מלאכותית בסיכון גבוה. החברה הוסיפה שהיא מתכננת לעבוד עם גורמים בתעשייה בשבועות הקרובים כדי לשפר שיטות בדיקה משותפות למודלי בינה מלאכותית מתקדמים.

מהי מניית הבינה המלאכותית הטובה ביותר לקנייה?

לא ל-Anthropic ולא ל-OpenAI יש מניה שנסחרת בבורסה, משום שמדובר בחברות פרטיות. עם זאת, שתי החברות הגישו בחשאיות מסמכים להנפקה ראשונית לציבור (IPO), והן עשויות להפוך לציבוריות בהמשך ב-2026 או ב-2027. כדי להישאר מעודכנים בתוכניות ההנפקה של Anthropic ושל OpenAI, משקיעים יכולים לבקר ב-מרכז החברות הפרטיות של TipRanks.