בדיקות פנימיות הובילו את OpenAI לקבוע שאי אפשר לשלול מ-Astra יכולת סייבר בדרגת Critical. החברה עצרה פעילויות שלא עומדות בבקרות החדשות, הגבילה גישה לרשת ולכלים והרחיבה את הניטור.
OpenAI הודיעה ב-7 באוגוסט כי עצרה פעילויות מסוימות בפיתוח Astra, מודל עתידי של החברה, לאחר שבדיקות פנימיות הצביעו על קפיצה ביכולות קוד וסייבר. המסקנה של צוות ההערכה הייתה שאי אפשר לשלול שהמודל מגיע לדרגת Critical במסגרת המוכנות של החברה. כל עבודה שאינה עומדת בבקרות שהוגדרו לדרגה הזאת הושהתה.
ההחלטה אינה השהיה מלאה של הפרויקט ואינה הודעה על ביטול השקה. OpenAI ממשיכה להעריך את המודל בסביבות מבודדות ולהוסיף אמצעי הגנה. Axios דיווחה שמועד השחרור, אם יהיה כזה, אינו ברור כרגע. החברה לא מסרה תאריך קודם או חדש.
מה פירושה של דרגת Critical
במסגרת המוכנות של OpenAI, דרגת Critical בסייבר מתייחסת ליכולת לזהות ולפתח חולשות zero-day פעילות במערכות קריטיות ומוקשחות, או לבצע מתקפה חדשה מקצה לקצה מתוך מטרה כללית, בלי שאדם ינחה כל שלב. זו רמה מעל High, הדירוג שקיבלה GPT-5.6 Sol בהערכות הקודמות של החברה.
חשוב להפריד בין סף הערכה לבין הוכחה שמערכת נפרצה. OpenAI לא טענה ש-Astra שימש בתקיפה, ואף הבהירה שהמודל לא היה מעורב באירוע האבטחה האחרון של Hugging Face. ההודעה עוסקת במה שהמודל עשוי להיות מסוגל לבצע בתנאי בדיקה, ובסיכון שנדרש לנהל לפני גישה רחבה.
הבקרות ש-OpenAI מוסיפה
לפי החברה, עבודת ההערכה מתקיימת כעת בסביבות ניסוי מבודדות, עם הגבלה של גישה לרשת, לכלים וליעדי בדיקה. החברה מציינת גם הגנות חזקות יותר על משקלי המודל, הצפנה, sandboxing, זיהוי שימוש חריג וניטור רחב של הפעלות. חלק מהבדיקות יתקיימו בשיתוף גופי ממשל וארגוני בטיחות AI.
הצעדים האלה חשובים במיוחד לחוקרי אבטחה, לחברות שמפעילות תשתיות רגישות ולמפתחים שעשויים לקבל גישה מוקדמת. אם Astra ישוחרר, סביר שהגישה לכלי סייבר, לרשת ולסביבות ביצוע תהיה מרכיב מרכזי בתנאי השימוש. גם ארגונים שירצו להפעיל את המודל אצלם יצטרכו להבין אילו הרשאות הוא מקבל, מה נרשם ביומן ומתי נדרשת עצירה אנושית.
מה עדיין חסר
הראיות שפורסמו מוגבלות. OpenAI לא הציגה ציוני הערכה, תרחישי בדיקה, שיעורי הצלחה או ביקורת עצמאית שמאפשרים לכמת את היכולת. גם המונח Astra מתייחס למודל שטרם שוחרר, ולכן אין למפתחים דרך לבדוק אותו בעצמם. לא פורסם אם גורם חיצוני ניסה לשחזר את התוצאות או בחן את התנהגות המודל בתנאים אחרים.
לא ידוע אילו פעילויות נעצרו, כמה זמן יידרש להשלים את הבקרות, מי יקבל גישה ראשונה או אם היכולות ישתנו לפני שחרור. ההחלטה כן מספקת איתות ברור: כאשר הערכה פנימית מתקרבת לסף הסייבר הגבוה ביותר של החברה, לוח הזמנים כפוף לאמצעי ההגנה ולא רק לאיכות המודל.
מקורות
- OpenAI7.8.2026
- Axios7.8.2026
- TechCrunch8.8.2026
VibeTech
כתב/ת טכנולוגיה ב-VibeTech



