הבלוג זמין כרגע בעברית. מחפשים שירותי AI, תוכנה או סייבר באנגלית? בקרו באתר ההנדסה באנגלית.

Claude Fable 5.1: אותו מחיר, קריאות מטמון זולות ב-75% — ושלושה שינויים שוברים ב-API

איתי ליפשיץ
איתי ליפשיץ
בינה מלאכותית7 דקות קריאהעודכן: 4 בספטמבר 2026
תוכן בסיוע AI
שתף:

ב-1 בספטמבר 2026 שחררה Anthropic את Claude Fable 5.1, ואיתו את התאום שלו לגישה מוגבלת, Mythos 5.1. במבט ראשון זו נראית גרסת נקודה שגרתית: מחיר הבסיס לא זז, השם כמעט זהה, ההכרזה קצרה.

במבט שני מתגלים שלושה דברים שמשנים את החישוב. קריאות מטמון ירדו ב-75%. הביצועים במשימות מדע סוכניות יותר מהוכפלו. ושלושה שינויים ב-API ישברו קוד קיים — לא בעדינות, אלא בשגיאת 400.

הגרסה הזאת יצאה באותו שבוע שבו OpenAI שחררה את GPT-6 Astra וגוגל את Gemini 3.8 Flash. מי שמשווה בין השלוש צריך להסתכל לא רק על מחיר הרשימה, אלא על מה שקורה לחשבון כשהעומס סוכני.

מה שחשוב לדעת

  • מחיר הבסיס לא השתנה — 10 דולר למיליון טוקני קלט, 50 דולר לפלט, בדיוק כמו Fable 5
  • קריאות מטמון ירדו מ-1.00 דולר ל-0.25 דולר למיליון טוקנים — ירידה של 75%
  • Terminal-Bench-Science 0.1: 52.6% מול 24.7% ב-Fable 5 — יותר מהכפלה
  • שלושה שינויים שוברים ב-API שמחייבים תיקון קוד לפני שדרוג
  • Mythos 5.1 הוא אותו מודל עם מעטפת safeguards אחרת, סגור לארגונים מסוננים בלבד
  • החיסכון בפועל: כ-25% לעומסים רגילים, עד כ-45% לעומסים סוכניים

התמחור: הסיפור נמצא במטמון

רכיבFable 5Fable 5.1שינוי
קלט (למיליון טוקנים)10 דולר10 דולרללא שינוי
פלט (למיליון טוקנים)50 דולר50 דולרללא שינוי
קריאת מטמון1.00 דולר0.25 דולרירידה של 75%
עיבוד באצווה5 / 25 דולרחצי מהמחיר הרגיל

כדי להבין למה זה משנה, צריך לדעת איך נראה חשבון של סוכן. סוכן קידוד שרץ על מאגר קוד קורא שוב ושוב את אותו הקשר: הוראות המערכת, מבנה הפרויקט, קבצי התיעוד, ההיסטוריה של השיחה. החלק הזה כמעט לא משתנה בין קריאה לקריאה — ולכן הוא נשמר במטמון.

בעומס סוכני טיפוסי, החלק הקבוע הזה יכול להוות 80% ויותר מטוקני הקלט. כשמחיר הקריאה ממנו יורד פי ארבעה, החשבון הכולל יורד באופן משמעותי גם אם מחיר הרשימה לא זז בכלל.

כמה זה באמת חוסך

ניקח דוגמה מוחשית. סוכן שמריץ 1,000 קריאות ביום, כל אחת עם 50 אלף טוקני הקשר קבוע ו-5,000 טוקנים משתנים:

  • ההקשר הקבוע: 50 מיליון טוקנים ביום מהמטמון. ב-Fable 5 זה 50 דולר; ב-5.1 זה 12.50 דולר.
  • החלק המשתנה: 5 מיליון טוקנים במחיר מלא — 50 דולר בשתי הגרסאות.
  • סך הכול: 100 דולר ביום מול 62.50 דולר. חיסכון של 37.5%.

Anthropic עצמה נוקבת בטווח של 25% לעומסים טיפוסיים ועד 45% לעומסים סוכניים מובהקים, וזה מסתדר עם החישוב. המסקנה המעשית ברורה: אם אתם לא משתמשים ב-prompt caching, אתם משלמים פי ארבעה על החלק הקבוע של הפרומפט. הגרסה הזאת הופכת את זה מאופטימיזציה נחמדה לפער שקשה להצדיק.

הבנצ'מרקים

בנצ'מרקFable 5.1להשוואהמה נמדד
Terminal-Bench-Science 0.152.6%Fable 5: 24.7% · Opus 5: 29.0%משימות מדע בטרמינל
Terminal-Bench 4.055.8%עבודה כללית בטרמינל
CursorBench 3.2.073.4%קידוד בסביבת עורך
Humanity's Last Exam60.9% / 65.0%בלי כלים / עם כליםשאלות ברמת מומחה
OSWorld 2.077.9% / 41.7%Opus 5: 75.4% / 39.6%שימוש במחשב, חלקי / מחמיר

הסייג שכדאי לקרוא לפני שמתלהבים

בפרסום עצמו מופיע נתון שקל לפספס: שגיאת התקן היא 3.5 עד 4.5 נקודות למודל. זה משנה את הפרשנות של כל שורה בטבלה.

הפער ב-Terminal-Bench-Science — 52.6% מול 29.0% של Opus 5 — הוא כ-23 נקודות. זה גדול פי חמישה מטווח השגיאה, ולכן אמיתי ומשמעותי. לעומת זאת, הפער ב-OSWorld מול Opus 5 עומד על 2.5 נקודות בהגדרה החלקית ו-2.1 בהגדרה המחמירה. שני המספרים האלה נמצאים בתוך רעש המדידה.

במילים אחרות: אם אתם שוקלים שדרוג בגלל שיפור בשימוש במחשב, המספרים לא תומכים בהחלטה. אם אתם שוקלים שדרוג בגלל עבודה מדעית או סוכנית — הם כן, ובבירור.

שלושה שינויים שוברים ב-API

זה החלק שידרוש עבודה בפועל. אלה אינם שינויי התנהגות עדינים — הם מחזירים שגיאות.

אכיפת שימוש בכלים בוטלה

הגדרת השדה tool_choice לערך any או לערך tool מחזירה כעת שגיאת 400. עד כה זה היה הדפוס המקובל לכפות על המודל לקרוא לכלי במקום לענות בטקסט חופשי.

מי שהסתמך על זה צריך לעבור לאחת משתי גישות: ניסוח מפורש בפרומפט שמנחה את המודל לקרוא לכלי, או ולידציה בצד שלכם שדוחה תשובה שאינה קריאת כלי ומבקשת שוב. הגישה השנייה אמינה יותר אבל עולה בטוקנים.

כיווניות של בלוקי חשיבה

Fable 5.1 קורא בלוקי חשיבה שנוצרו על ידי מודלים קודמים, אבל אף מודל קודם אינו קורא את בלוקי החשיבה שלו. זה שובר צנרות שמעבירות היסטוריית שיחה בין דורות מודלים — דפוס נפוץ במערכות שמנתבות בקשות בין מודלים לפי מורכבות.

אם המערכת שלכם מנתבת בקשות פשוטות למודל זול ומורכבות ל-5.1, ומעבירה ביניהם היסטוריה מלאה, כדאי לבדוק את הכיוון הזה לפני העלייה לייצור.

הגבלה על עריכת שיחה

הזרקה ומחיקה של תזכורות לכל תור מחזירות כעת שגיאה. זהו דפוס מוכר בסוכנים ארוכי טווח: מזריקים לכל תור תזכורת קצרה עם המצב הנוכחי, ומוחקים את הקודמת כדי לא לנפח את ההקשר.

החלופה היא לרכז את המצב המשתנה בהודעה אחת שמתעדכנת, או להעביר אותו כפלט של כלי במקום כהודעת מערכת.

מה השתנה ב-safeguards

Anthropic כיילה מחדש את מנגנוני הבטיחות, והפעם דווקא בכיוון של פחות חיכוך:

  • סייבר: המדיניות מתירה כעת גילוי חולשות אך אוסרת על פיתוח exploit. התוצאה המדווחת — ירידה של כ-60% בהתערבויות לכל סשן ב-Claude Code.
  • ביולוגיה: המסננים נדלקים ב-85% פחות על בקשות לגיטימיות.

מי שעבד עם Claude Code על קוד אבטחה מכיר את הבעיה: המודל היה עוצר באמצע משימה לגיטימית לגמרי כי היא נגעה בניתוח חולשות. ירידה של 60% בהתערבויות היא שיפור מוחשי בשימוש היומיומי.

ההבחנה בין גילוי חולשה לבין פיתוח exploit היא בדיוק הקו שכל המעבדות ניסו לשרטט באותו שבוע — ניתחנו את הדפוס הזה בנפרד.

Mythos 5.1 ומודל הגישה הכפול

Mythos 5.1 אינו מודל נפרד. זהו אותו מודל בסיס בדיוק, עם שכבות safeguard שונות, והגישה אליו מוגבלת לארגונים אמריקאיים מסוננים במסגרת Project Glasswing.

הדפוס הזה — מודל ליבה אחד, שתי מעטפות הרשאה — חזר על עצמו אצל שלוש המעבדות הגדולות בתוך שבוע. גוגל עשתה בדיוק את זה עם Gemini 3.8 Flash ו-Flash Cyber, ו-OpenAI עם תוכנית Daybreak. מי שמחוץ לרשימה מקבל את הגרסה הציבורית, וזה כנראה המצב לטווח הנראה לעין.

המספרים היבשים

  • חלון הקשר: מיליון טוקנים
  • פלט מקסימלי: 128 אלף טוקנים
  • זמינות: Fable 5.1 כללית; Mythos 5.1 בגישה מסוננת בלבד
  • תאריך שחרור: 1 בספטמבר 2026

מה זה אומר לצוותים בישראל

עבור רוב הצוותים שבונים על Claude, ההמלצה המעשית מתחלקת לארבעה צעדים:

  • הריצו את מערך הבדיקות מול 5.1 לפני שמעבירים תעבורה. שלושת השינויים השוברים מחזירים 400, ולא תגלו אותם בהדרגה — הם ייפלו מיד.
  • בדקו אם prompt caching מופעל. זה המקום שבו נמצא כל החיסכון בגרסה הזאת. צוות שלא משתמש במטמון לא ירגיש שום שיפור בחשבון.
  • אל תשדרגו בגלל OSWorld. הפער מול Opus 5 נמצא בתוך שגיאת המדידה. אם העומס שלכם הוא שימוש במחשב, מדדו על העבודה האמיתית שלכם.
  • כן שקלו שדרוג לעומסים מדעיים וסוכניים. קפיצה מ-24.7% ל-52.6% אינה רעש — היא הבדל תפקודי.

שאלות נפוצות

האם צריך לשדרג מיד? לא. Fable 5 ממשיך לעבוד. השדרוג מוצדק אם אתם משתמשים במטמון בהיקף משמעותי, או אם העומס שלכם סוכני-מדעי.

כמה עבודה דורשים השינויים השוברים? לרוב הצוותים — שעה עד יום. השינוי הכי מורכב הוא ביטול אכיפת הכלים, שדורש ניסוח מחדש של הלוגיקה סביב קריאות כלי.

האם המחיר יעלה בהמשך? בניגוד ל-Gemini 3.8 Flash, שהמחיר שלו מוכפל בינואר 2027, Anthropic לא הכריזה על תמחור זמני. המחירים כאן הם מחירי רשימה רגילים.

אפשר לקבל גישה ל-Mythos 5.1? רק ארגונים אמריקאיים מסוננים במסגרת Project Glasswing. לישראלים זו אינה אופציה מעשית כרגע.

שורה תחתונה

Fable 5.1 היא גרסת נקודה שמתנהגת כמו גרסה גדולה. הקפיצה במשימות מדעיות סוכניות אמיתית וגדולה מטווח השגיאה. ההוזלה במטמון משנה את כלכלת ההרצה של סוכנים ארוכי טווח. וכיול הבטיחות מפחית חיכוך יומיומי שהיה מטריד בעבודה על קוד אבטחה.

המחיר הוא שלושה שינויים שוברים ב-API. עבור רוב הצוותים, יום עבודה של התאמה מול חיסכון של רבע עד כמעט מחצית מהחשבון החודשי הוא חישוב פשוט. רק אל תדלגו על שלב הבדיקות — השגיאות כאן אינן עדינות.

מאמרים קשורים

מהקריאה לבנייה

יש לכם מערכת שצריכה לעבוד עם AI?

אני עוזר לעסקים להפוך מודלים, אוטומציות ותשתיות מאובטחות למערכות שאפשר להפעיל בפרודקשן.

בואו נדבר על הפרויקט
Claude Fable 5.1: בנצ'מרקים, תמחור מטמון ושינויי API שוברים