על מה המדריך?
השבוע נפל דבר בעולם ה-AI: המודלים החדשים של OpenAI ואנתרופיק סווגו כבעלי 'סיכון קריטי' לסייבר. החברות השאירו אותם מאחורי סורג ובריח.
זה התחיל בבוקר רגיל. ניסיון להריץ סקריפט בדיקה על המודל החדש נתקל בהודעת שגיאה אדומה. לא 'שרת עמוס', אלא 'הפעולה מסוכנת מדי'.
מה קרה ב-1 בספטמבר?
OpenAI אישרה רשמית כי מודל ה-Astra הוא הראשון מתוצרתה שחוצה את סף ה-'Critical' (סיכון קריטי) תחת מסגרת המוכנות שלה. המשמעות היא שהמודל מסוגל לזהות ולנצל פרצות אבטחה ללא סיוע אנושי. במקביל, אנתרופיק הגבילה את הגישה למודל Mythos 5.1 לקבוצות מחקר מורשות בלבד, כחלק ממאמץ למנוע שימוש לרעה במערכות בעלות יכולות אוטונומיות גבוהות.
הרגולציה נכנסת לחדר
בוושינגטון, הצעת החוק 'AI Kill Switch Act' (H.R. 9917), שהוגשה על ידי חברי הקונגרס טד ליו ונתניאל מורן, תופסת תאוצה. החוק דורש מהחברות להחזיק מנגנון השבתה טכני למודלים מסוכנים. בעוד התומכים רואים בכך צעד הכרחי לביטחון הלאומי, מבקרים מזהירים כי כפתור השמדה עלול להיות לא יעיל מול מודלים מבוזרים ועלול לפגוע בחדשנות האמריקאית מול תחרות בינלאומית.
הדילמה של המשתמש
עבור המשתמש הממוצע, המציאות החדשה מורכבת. מצד אחד, הגבלת הגישה למודלים החזקים ביותר יוצרת 'שומרי סף' שבהם רק גופים גדולים נהנים מהטכנולוגיה. מצד שני, האירועים של יולי, שכללו תקיפות אוטונומיות על תשתיות כמו Hugging Face, הוכיחו כי ללא בקרות הדוקות, הכלים שאנו בונים עלולים להפוך לנשק נגדנו.
מה חדש שכדאי להכיר
- • סיווג 'סיכון קריטי' (Critical Risk) למודלים בעלי יכולות סייבר מתקדמות.
- • הגבלת גישה למודל Claude Mythos 5.1 למוסדות מאושרים בלבד.
- • פיתוח יכולות 'Kill Switch' כדרישה רגולטורית עתידית.