דלגו לתוכן הראשי
ANTHROPIC IL
ניוזלטרמדד כלכליטיפיםהנדסה באנתרופיקמחקרמודליםחדשותראשי
ANTHROPIC IL

הקהילה הישראלית של Anthropic. חדשות, מחקרים, מדריכים ועדכונים על Claude ועל כלי ה-AI של אנתרופיק - בעברית.

RSS support@anthropic-il.co.il

הישארו מעודכנים

הצטרפו לניוזלטר השבועי וקבלו את כל העדכונים החמים מעולם ה-AI ישירות למייל.

מדורים

  • חדשות
  • מחקר
  • הנדסה
  • כלכלה
  • טיפים וטריקים
  • קהילה
  • ניוזלטר
  • חיפוש

משפחת Claude

  • Claude Code (קלוד קוד)
  • Claude - סקירה
  • Claude Sonnet
  • Claude Opus
  • Claude Haiku

נושאים חמים

  • בינה מלאכותית
  • מודלי שפה
  • LLMs
  • Anthropic API
  • סוכני AI
  • קידוד סוכני
  • מודלי חזית

מחקר ובטיחות

  • בטיחות AI
  • AI אחראי
  • מחקר AI
  • פרשנות מודלים
  • יישור (Alignment)
  • Red Teaming
  • מדיניות ורגולציה

אתרי אחות

  • קלודLEARN - לימוד
  • מבוא ל-LLMs
  • הזיות בקלוד
  • פרומפט ראשון
אודות·מדיניות פרטיות·תנאי שימוש·צור קשר
כל הזכויות שמורות Anthropic IL © 2026
אנתרופיק | אנטרופיק ישראל | אנטרופיק בעברית | Anthropic Israel

אתר קהילתי בלתי רשמי - אתר זה אינו קשור, מאושר או מופעל על ידי חברת Anthropic, PBC. התכנים מתורגמים באופן אוטומטי מ-anthropic.com ועשויים להכיל אי-דיוקים. כל הסימנים המסחריים הם רכוש בעליהם.

ראשי/SWE-bench

SWE-bench

1 כתבות בנושא זה

קלוד 3.5 Sonnet קובע רף חדש ב-SWE-bench Verified
הנדסה4 במרץ 2025

קלוד 3.5 Sonnet קובע רף חדש ב-SWE-bench Verified

מודל ה-LLM החדש של אנתרופיק (Anthropic), Claude 3.5 Sonnet, מציג קפיצת מדרגה משמעותית בביצועים על מדד SWE-bench Verified, ומגיע ל-49%, מעל מודלי החזית המובילים. הכתבה בוחנת את היכולות המתקדמות של המודל בתחום הנדסת התוכנה ודיוק יצירת הקוד, ומסבירה את שיטות ההערכה הטכניות ששימשו לבחינת הסוכן. היא מדגימה כיצד שילוב מודל ה-AI עם פיגומים (scaffolding) מינימליסטי ויעיל, מאפשר למפתחים למצות את הפוטנציאל המרבי שלו למשימות קידוד סוכני.

קרא עוד