ממשלת ארה"ב הורתה ל‑Anthropic לנתק גישה ל‑Fable 5 ול‑Mythos 5 בעקבות חששות מפריצת jailbreak

התערבות ממשלתית פוגעת במודלים החדשים של Anthropic
ממשלת ארה"ב הורתה ל‑Anthropic להשעות מיידית את הגישה לשני ממערכות ה‑AI המתקדמות שלה, Claude Fable 5 ו‑Claude Mythos 5, בטענה לחששות ביטחון לאומי הקשורים בפוטנציאל לפריצת גישות (jailbreak).
Anthropic ציינה כי קיבלה את ההוראה ביום שישי בשעה 17:21 לפי שעון מזרח ארה"ב וכי עמדה בה, ובו בזמן טענה שהממשלה "טעתה במקרה הזה". החברה הוסיפה כי הפקודה מחייבת אותה לנטרל גישה לשני המודלים ברחבי העולם, ולא רק לאזרחים זרים, אף על פי שהפעולה הוצגה כצעד של בקרת יצוא.
המהלך מגיע ברגע רגיש עבור Anthropic. Mythos 5 הוא המודל המתקדם ביותר של החברה והוא נשמר תחת מגבלות מחמירות בגלל יכולתו המדווחת לחשוף תקלות אבטחה בתוכנה. Anthropic אמרה שביצעה בדיקות על המודל בכל מערכות ההפעלה הדומיננטיות והדפדפנים ומצאה פגיעויות בכל אחת מהן. במקום לשחרר אותו באופן נרחב, הגבילה החברה את הגישה דרך Project Glasswing, תוכנית מבוקרת שכללה כ‑50 ארגונים מאומתים ביניהם Amazon, Apple, Google, Microsoft ו‑CrowdStrike.
Fable 5, שפורסם רק לפני שלושה ימים, היה הגרסה הציבורית של Mythos 5, מעוצבת עם סוככים להגנה כדי לחסום נושאים בסיכון גבוה כמו אבטחת סייבר וביולוגיה. החברה טענה כי האמצעים האמורים הופכים אותו למתאים לשחרור לציבור, ובדיקות תקן של Vals AI כבר הציבו אותו בראש השדה הציבורי.
Anthropic אמרה שהחשש של הממשלה נדמה שמתרכז בטענת פריצת jailbreak של Fable 5. לפי החברה, הרשויות סיפקו עד כה הוכחות בעל־פה בלבד לגבי "פריצת גבול צר, לא אוניברסלית" שכוללת פרומפטים שמכוונים לגרום למודל לבדוק בסיס קוד ולזהות פגמים בתוכנה. Anthropic ציינה כי יכולת זו כבר קיימת במודלים ציבוריים אחרים, כולל OpenAI ו‑GPT‑5.5, ומשמשת שגרתי לעבודות הגנת סייבר.
החברה גם טענה שההגנות החזקות ביותר שלה נשענות על מערכות מסווגות עצמאיות המופרדות מהמועדל עצמו, כלומר פריצה לא בהכרח תעקוף את ההגנות היסודיות נגד פלטים מסוכנים.
עם זאת, צו הממשלה הוא עדות חדה לקצב שבו AI מתקדם הופך לנושא ביטחוני לאומי — ולנכונותם הגדלה של הרגולטורים להתערב כשהם סבורים שמודל חצה סף מסוים.
מקורות: