שיפור מנגנוני הבטיחות הביולוגיים של Fable 5
אנו מבצעים עדכונים למנגנוני הבטיחות הביולוגיים של Fable 5 באופן שמפחית באופן משמעותי את חיובי הכזב. משתמשי Fable 5 יחוו כעת הרבה פחות 'fallbacks' – בהם המערכת עוברת למודל בעל יכולות נמוכות יותר לאחר שהם מגישים שאילתה הקשורה לביולוגיה. בבדיקות שלנו, עדכון זה הפחית את ה-'fallbacks' הקשורים לביולוגיה בכ-85% בכלל ממשקי המוצר שלנו.
Fable 5 יוכל, אם כן, לסייע במגוון רחב יותר של משימות ביולוגיה.
בפועל, משתמשים אמורים לראות הרבה פחות 'fallbacks' בשאלות יומיומיות בתחומי הבריאות והחינוך – לדוגמה, פירוש תוצאות מעבדה, הבנת סימפטומים ולמידה על ביולוגיה בהקשר חינוכי. אנשי מקצוע בתחום הבריאות יוכלו לקבל תמיכה רבה יותר מ-Fable 5 במשימות קליניות.
אנו מאמינים כי ההזדמנות הגדולה ביותר עבור AI להשפיע באופן חיובי על העולם טמונה בביולוגיה וברפואה, ואנו משקיעים משמעותית בבניית דרך אחראית להעניק לביולוגים גישה למודל חזית. כיום, Fable עדיין עובר ל-Opus 5 עבור בקשות שאנו רואים כדו-שימושיות – כולל וירולוגיה, טוקסיקולוגיה ותכנון מולקולרי – ולכן הוא עדיין אינו שמיש למחקר ביולוגי מקצועי ולפיתוח תרופות. אנו מחויבים לסגור את הפער הזה באמצעות מסלולי גישה מהימנים ליכולות ביולוגיות חדשניות.
מדוע בנינו מנגנוני בטיחות חזקים לביולוגיה
מטרתנו היא להביא את יכולות מודל החזית של Fable 5 לידיים של כמה שיותר ממשתמשינו, במהירות האפשרית. עם זאת, כדי לעשות זאת, עלינו לנהל את הסיכונים הגוברים שמגיעים עם מודלים בעלי יכולות כאלה. אחד הסיכונים הללו הוא בתחום הביולוגיה: Fable 5 יכול כעת לעלות על מומחים במשימות ביולוגיות מורכבות ביותר ולספק תמיכה תפעולית באחרות. משמעות הדבר היא שהוא יכול לספק סיוע אמיתי לחוקר המפתח טיפול רפואי חדש (וזו הסיבה שאנו כה להוטים להרחיב את הגישה למודל באמצעות שיפורי מסווגים ותוכניות גישה מהימנות).
אך בידיים הלא נכונות, אותן יכולות יכולות לשמש גורם זדוני, לדוגמה בפיתוח נשק ביולוגי. אומדני היכולות שלנו מראים כי Fable 5 יכול לספק הגברת יכולת משמעותית לגורם כזה – כלומר, הוא יכול לספק לו יכולות שלא היה מוצא בשום מקום אחר.
לעיתים קרובות קשה להבחין בין שימושים מועילים לשימושים מזיקים של AI בביולוגיה. לדוגמה, במקרים מסוימים מחקר טיפול למחלה דורש ממדענים לייצר את התרכובות המסוכנות שגורמות למחלה מלכתחילה. הדבר בולט במיוחד בחיסונים חיים, הדורשים ממדענים לגדל את אותו פתוגן שהם שואפים למנוע. זה המצב גם לגבי תרופות מסוימות. כדי לפתח את התרופה קפטופריל, המטפלת ביתר לחץ דם, מדענים בודדו רכיבים רעילים מארס נחש המפילים את לחץ הדם בבני אדם. ככל שמתפתחות יכולות ביולוגיות חדשות בחזית ה-AI, עלינו לנקוט זהירות כדי להבטיח שהסיכונים החדשים שהן מציבות לא יתממשו לפני היתרונות המדעיים הפוטנציאליים שלהן.
אומדן האיומים השנתי של קהילת המודיעין האמריקאית לשנת 2026 מבהיר כי גורמים כאלה קיימים, וכי התקדמות בביוטכנולוגיה, כולל ביולוגיה סינתטית ועריכה גנומית, "עלולה להוביל לאיומים ביולוגיים חדשים". הוא מציין כי כמה גורמי מדינה ככל הנראה מקיימים תוכניות נשק ביולוגי וכימי התקפיות פעילות – תוכניות שעלולות להיות מואצות באמצעות גישה ליכולות הגולמיות של מודלי AI חזיתיים.
בשל חששותינו לגבי יכולות "דו-שימושיות" אלה (אלו שניתן להשתמש בהן למטרות מועילות או מזיקות, ושבהן הקו המפריד אינו תמיד קל לשרטוט), השקנו בכוונה את Fable 5 כאשר כמעט כל שאילתות הביולוגיה חסומות. זה איפשר לנו להנגיש את המודל למשתמשים בתחומים אחרים. ידענו שזה יהיה מתסכל עבור משתמשי ביולוגיה לגיטימיים: זה יוביל למספר גבוה של חיובי כזב בטווח הקצר, כאשר בקשות של משתמשים השואלים שאלות הקשורות לביולוגיה ייחסמו ויישלחו למודל פחות מסוגל. עם זאת, בחרנו לבצע את הפשרה הזו מכיוון שעלות השימוש לרעה ב-Fable בתחום דו-שימושי כמו ביולוגיה עלולה להיות קטלנית.
כיצד פועלים מנגנוני הבטיחות הביולוגיים שלנו
אחת הדרכים המרכזיות בהן אנו מגנים מפני שימוש לרעה בביולוגיה היא באמצעות מסווגי בטיחות: מערכות AI אוטומטיות קטנות יותר המזהות מתי Fable 5 מתבקש לבצע משימה ביולוגית מוגנת, או לייצר פלט מזיק (כבר כתבנו בעבר על מסווגים דומים שלנו בתחום אבטחת הסייבר).
במקרה של Fable 5, כאשר מסווג מופעל, המודל מנתב מחדש את בקשת המשתמש ל-Opus 5, מודל בעל יכולות שאינו בעל אותה רמה של יכולת ביולוגית כמו Fable 5 ואינו יכול לספק סיוע רב כל כך למשתמש זדוני. זהו ה-'fallback' שמשתמשים רואים כאשר בקשותיהם נחסמות.
פיתוח מסווגים מדויקים וחזקים אינו משימה פשוטה. כדי שמסווג יעבוד במהירות ובעקביות, עליו ללמוד את ההבדל בין מה שאנו רואים כ"בתחום ההגדרה" ו"מחוץ לתחום ההגדרה" עבור הנושאים והשאילתות שאנו רואים כעלולים להזיק. נדרש זמן וחזרות כדי לכוונן את המסווגים, תוך הימנעות הן מחיובי כזב (בהם המסווגים מופעלים על תוכן מחוץ לתחום ההגדרה) והן משלילי כזב (בהם תוכן בתחום ההגדרה אינו מזוהה). אנו דורשים גם שהמסווגים שלנו יהיו חסינים מפני ניסיונות לעקוף אותם (הידועים כפריצות מגבלות), מה שמצריך מחקר ובדיקות נוספים.
התחלה עם מסווג ביולוגיה רחב מאוד איפשרה לנו להעניק למשתמשינו גישה ל-Fable 5 בזמן שהמשכנו במחקרנו שמטרתו לחדד אותו. האלטרנטיבה – לעכב את המודל עד שתושג התקדמות רבה יותר במנגנוני ההגנה – הייתה מעכבת את הגישה הכללית למודל, ואת יתרונותיו הפוטנציאליים למשתמשינו, בשבועות או חודשים.
במהלך השבועות האחרונים, כתבנו מחדש בקפידה את חוקת המסווג (המורכבת מאוסף כללים המסייעים למודל להבחין בין תוכן מוגן לתוכן מותר), תוך הקפדה על הפרדה מפורטת של שימושים שפירים. אספנו משוב על השינויים ממגוון רחב של מומחים (פנימיים וחיצוניים לאנתרופיק). לאחר מכן, פיתחנו נתוני אימון מעודכנים למסווג בהתבסס על אותה חוקה, ואימנו אותו מחדש, ואימתנו שהמסווג החדש עדיין יופעל באופן כללי עבור תוכן מחקרי ביולוגי מזיק ודו-שימושי, אך כעת יאפשר מגוון רחב יותר של שימושים שפירים ומועילים.
כפי שמודגם בתרשים להלן, עדכונים אלה משמעותם – בהשוואה למועד השקת Fable 5 – שהמסווג יופעל עבור הרבה פחות בקשות ביולוגיות שפירות.

מסקנות
יש עוד הרבה מה לעשות כדי לחדד את מנגנוני ההגנה שלנו. יישארו באופן בלתי נמנע חיובי כזב – בקשות הנופלות בתוך טווח הבטיחות של המסווג, שבהן הבקשה היא בעלת סיכון נמוך מאוד אך המסווג עדיין מופעל. כפי שציינו לעיל, Fable ימשיך לחסום שאילתות מקצועיות בביולוגיה ופיתוח תרופות בשל פוטנציאל הסיכון הדו-שימושי. אנו מחויבים באופן מלא לפתח נתיב בטוח וניתן להרחבה עבור חוקרים לשימוש במודלים בעלי היכולות הגבוהות ביותר שלנו באמצעות מסלולי גישה מהימנים.
אנו מקווים שתמשיכו לשתף אותנו במשוב שלכם כדי שנוכל לשפר את מנגנוני ההגנה שלנו אף יותר.
הערות שוליים
1 כתוצאה מכך, אנו מצפים שגם המספר הכולל של ה-'fallbacks' – הקשורים לביולוגיה או מכל סיבה אחרת – יופחת: בכ-67% ב-Claude.ai, ב-55% ב-Cowork, ב-17% ב-Claude Code, וב-7% ב-Claude Platform.


