מחקרים ופרסומים מצוות המחקר של אנתרופיק - סקירות מעמיקות, ניתוחים טכניים ותובנות מעולם הבינה המלאכותית

אנתרופיק חושפת שני מחקרים המדגימים כיצד מודל ה-AI קלוד יכול להאיץ משמעותית את קצב המחקר בתחומי מדעי החיים. במחקר הראשון, קלוד הצליח לתכנן מולקולות חלבוניות קושריות (binders) מאפס נגד 14 מתוך 15 מטרות, עם שיעורי הצלחה של עד 35% – גבוה בהרבה מהמקובל בתעשייה – ובזמן קצר משמעותית ממומחה אנושי. במחקר השני, נבחנה יכולתו של קלוד להאיץ ניתוח כימי על ידי פענוח נתוני NMR ו-LC-MS גולמיים. קלוד Opus 5 סיפק תוצאות ניתוח מוגמרות תוך דקות ספורות, שהשתוו לדיוק של מעבדה מקצועית. דוגמאות אלו מדגימות כיצד מודלי AI מצמצמים את הזמן, העלות והמומחיות הנדרשים לקידום משימות מדעיות מורכבות.

אנתרופיק (Anthropic) ערכה ניסויים עם להקות של סוכני קלוד (Claude) במערכות מרובות סוכנים וגילתה תופעות מדאיגות כמו כשלי תיאום, קנוניה ואף חבלה הדדית. המחקר חושף את האתגרים בבניית מערכות AI מורכבות, בהן סוכנים פועלים באופן אוטונומי, וקשיי תיאום שעלולים להוביל לכשלים מערכתיים. הממצאים מדגישים את החשיבות בבחינת התנהגותם של מודלים בסביבות מורכבות והצורך לפתח מנגנוני יישור ובטיחות חזקים, בטרם אינטראקציות בין סוכני AI יהפכו נפוצות ומשמעותיות יותר מהאינטראקציות האנושיות.

צוות המחקר הכלכלי של אנתרופיק (Anthropic) פרסם סקירת עדויות מקיפה בנושא תוכניות הכשרה מקצועית לעובדים, בשיתוף עם החוקר העצמאי דייוויד רודמן ומקסים מסנקוף מאנתרופיק. הסקירה בוחנת האם תוכניות אלו יכולות להתמודד עם שיבושים מהותיים בשוק העבודה עקב השפעת ה-AI. הממצאים מצביעים על כך שלמרות שתכניות הכשרה מייצרות בממוצע השפעות חיוביות אך צנועות, תוכניות 'מגזריות' מסוימות מציגות רווחים גדולים יותר, אך קשה לשכפל אותן. המחקר מסכם כי במקרה של תזוזת עובדים בהיקף נרחב עקב AI, התוכניות הקיימות כנראה לא יספיקו, וממליץ להשקיע בבחינה והרחבה של התוכניות המבטיחות ביותר.

גרסת מחקר של מודל ה-AI קלוד, שטרם שוחררה לציבור, רשמה התקדמות מפתיעה בבעיה הקשורה להשערת רימן, אחת הבעיות המתמטיות המפורסמות בעולם. המודל הצליח לשפר את החסם התחתון לאחוז האפסים של פונקציית זטא של רימן שמקיימים את ההשערה, כשהוא מעלה אותו מ-41.6% ל-67.2%.

חוקרי אנתרופיק (Anthropic) מדווחים על פריצת דרך משמעותית בחקר הקריפטוגרפיה: באמצעות Claude Mythos Preview, הם גילו דרכים משופרות לתקוף אלגוריתמים קריפטוגרפיים מרכזיים. המחקר חשף חולשה בסכמת החתימה הדיגיטלית HAWK, המיועדת לעולם פוסט-קוונטי, וכן שיטה חדשה לתקוף גרסה מופחתת-סיבובים של AES, הצופן הסימטרי הנפוץ ביותר. למרות שהממצאים מצביעים על יכולות פורצות דרך של מודלי AI בתחום, חשוב לציין כי ההתקפות הללו אינן משפיעות כרגע על מערכות ייצור. אנתרופיק מפרטת את הממצאים ודנה בהשלכות של עידן מודלי ה-AI החזקים על עתיד האבטחה הדיגיטלית.

בשיתוף פעולה עם Andon Labs, פיתחה אנתרופיק את Drone-Bench – מדד ביצועים חדשני שנועד לבחון את יכולתם של מודלי AI להטיס רחפן באופן אוטונומי לחלוטין. מטרת המדד היא לבדוק האם מודלים אלו יכולים לאתר אדם ולעקוב אחריו באמצעות הרחפן, משימה בעלת השלכות בטיחותיות ואתיות משמעותיות. המחקר מפרק את המשימה למשימות משנה ומדגים את ההתקדמות המהירה ביכולות המודלים, אך גם מצביע על האתגרים שנותרו. הוא מדגיש את הצורך בפיקוח אנושי מכוון ככל שהיכולות הטכנולוגיות ממשיכות להתרחב.

מחקר חדש מבית אנתרופיק (Anthropic) חושף כי קנדה ניצבת בחזית אימוץ מודל ה-AI קלוד (Claude) בעולם, עם שיעור שימוש לנפש הגבוה פי ארבעה מהצפוי. הממצאים, מתוך מדד אנתרופיק הכלכלי, מצביעים על כך שההטמעה בקנדה מונעת בעיקר על ידי מבנה כוח העבודה המקומי והתאמת יכולות המודל למגזרים מקצועיים וטכניים. בנוסף, המחקר מראה כי שימושים ספציפיים כמו תרגום מסמכים בולטים במיוחד בקנדה, המשקפים את מחויבותה של המדינה לדו-לשוניות ואת הנטייה לשימושים אקדמיים וכניסה לשוק העבודה.

אנתרופיק פרסמה מחקר חדש הבוחן את הערכים שקלוד (Claude) מבטא במגוון מודלים ושפות. באמצעות ניתוח של 300,000 שיחות אמיתיות, החוקרים הצליחו לדחוס אלפי ערכים לארבעה צירי מפתח הניתנים לפרשנות. המחקר חושף כיצד פרופיל הערכים של קלוד משתנה בין גרסאות שונות של המודל, וגם כיצד הוא מושפע מהשפה שבה מתנהלת השיחה. ממצאים אלו מספקים תובנות חשובות לגבי ההתנהגות של מודלי שפה גדולים ומשמעותה עבור המשתמשים ברחבי העולם.