מחקר פורץ דרך משותף של חברת אנתרופיק (Anthropic) וCyLab מאוניברסיטת קרנגי מלון (Carnegie Mellon University), חושף ממצאים מדאיגים ומרתקים כאחד: מודלי שפה גדולים (LLMs) שאינם עברו כל כוונון עדין ספציפי בתחום אבטחת הסייבר, מסוגלים לבצע מתקפות סייבר מרובות-שלבים על רשתות מחשבים בגודל עסקי, המונות עשרות שרתים. יכולת זו מתאפשרת באמצעות ערכת כלים חדשנית שפותחה במיוחד עבורם. המחקר מצביע על דרך שבה LLMs יכולים להוריד את חסמי הכניסה למתקפות סייבר מורכבות, תוך כדי אוטומציה של תהליכי הגנה אקטואליים.
מחשבות מרושעות והכלים לביצוען: הכירו את Incalmo
החוקרים מאוניברסיטת קרנגי מלון ואנתרופיק פיתחו את ערכת הסייבר הייחודית Incalmo, המסייעת ל-LLMs לתכנן ולבצע מתקפות מורכבות. Incalmo פועלת כמתרגמת: היא לוקחת את ה"מחשבות" של ה-AI לגבי אופן התקיפה, וממירה אותן לפקודות המחשב הספציפיות הנדרשות לביצועה בפועל. מדובר בשינוי משחק דרמטי, והנה כמה מהממצאים המרכזיים:
- LLMs שהשתמשו ב-Incalmo הצליחו לפרוץ באופן מלא ל-5 מתוך 10 רשתות מבחן, ופרצו באופן חלקי ל-4 רשתות נוספות. לשם השוואה, ללא ערכת הכלים Incalmo, הם נכשלו כמעט לחלוטין.
- ההצלחה כללה תזמור רצף מורכב של שלבים, כולל קבלת גישה ראשונית לרשת, תנועה רוחבית בין מערכות והוצאת נתונים (exfiltration) על פני רשתות שכללו 25-50 שרתים.
- התרחישים שהוערכו במחקר היו מציאותיים ומתוחכמים יותר ממבחנים קודמים של LLMs על אתגרי אבטחת סייבר בסיסיים, אך המתקפות עדיין הסתמכו על פרצות ידועות, ולא על גילוי וניצול של פרצות חדשות. בנוסף, חלק מהכלים ב-Incalmo נבנו במיוחד עבור תרחישי מחקר אלה; יהיה צורך להוסיף כלים חדשים כדי לאיים על רשתות אמיתיות.




