במשפחת Claude יש כמה דגמים, ולכל אחד מחיר ומאפייני עבודה שונים. כדי להשוות ביניהם צריך להפריד בין שלושה דברים: הדגם עצמו, המנוי שדרכו ניגשים אליו, והמשימה שרוצים להשלים. מחיר נמוך לטוקן אינו אומר שהמשימה תעלה פחות אם נדרשות הרבה הרצות ותיקונים.

הנתונים הטכניים במאמר נבדקו ב-8 בספטמבר 2026. הם מתייחסים ל-API הישיר של Anthropic; המחיר והזמינות דרך שירות אחר עשויים להיות שונים. מי שמתחיל בצ׳אט יכול להתחיל במדריך קלוד AI בעברית.

הדגמים הנוכחיים והמזהים שלהם

קטלוג המודלים הרשמי מציג את ארבעת הדגמים הבאים בהרכב המרכזי. זו אינה רשימה של כל מודל היסטורי או של כל שירות בזמינות מוגבלת.

דגםמזהה ב-API הישירחלון הקשרפלט מרבי לבקשה
Fable 5.1claude-fable-5-1מיליון טוקנים128 אלף טוקנים
Opus 5claude-opus-5מיליון טוקנים128 אלף טוקנים
Sonnet 5claude-sonnet-5מיליון טוקנים128 אלף טוקנים
Haiku 4.5claude-haiku-4-5-20251001200 אלף טוקנים64 אלף טוקנים

חלון הקשר הוא מגבלת המידע שהמודל יכול לעבד בבקשה. הוא אינו הבטחה שהמודל יאתר כל פרט במסמך ארוך. גם מגבלת הפלט אינה אורך מומלץ: אם צריך תשובה של חמש שורות, הגדלת התשובה אינה מטרה בפני עצמה.

Anthropic ממקמת את Fable לעבודת חשיבה ממושכת, את Opus לעבודה מורכבת, ואת Sonnet ו-Haiku באיזונים אחרים של מהירות ויכולת. זו חלוקת היצרן; התאמה לתהליך שלכם דורשת בדיקה על חומר משלכם.

מבחני פיתוח וחשיבה בפרסום Fable

משפחת Claude: קוד והסקה
מבחןClaude Fable 5.1Claude Fable 5Claude Opus 5
Terminal-Bench 4.0קוד עם הגנות המוצר55.8%42.0%52.3%
CursorBench 3.2.0עבודה בסביבת פיתוח73.4%70.5%70.0%
HLE · no toolsללא כלים60.9%57.8%56.6%
HLE · with toolsעם כלים65.0%63.8%63.6%
מקור: מסמך התוצאות הרשמי · נבדק ב־09.09.2026

טבלת Anthropic מספטמבר 2026. גבוה עדיף; אלה תוצאות ההשוואה שפרסם היצרן, לא תנאים אחידים שהרצנו. Fable נבדק עם מנגנוני ההגנה של המוצר: בסירובי סייבר הופעל Opus 4.8 ובביולוגיה Opus 5, למעט החריגים המפורטים. הטבלה מתייחסת ל־Fable, לא לגרסת Mythos עם הגנות אחרות.

ההשוואה המספרית כאן מתמקדת בדגמים שמופיעים בטבלת Fable העדכנית של Anthropic: ‏Fable 5.1, ‏Fable 5 ו־Opus 5. היא אינה טבלת ציונים לכל הדגמים בקטלוג. היעדר Sonnet או Haiku בטבלה אינו ציון אפס ואינו קביעה לגבי התאמתם. שמרנו את גרסת Fable הקודמת כדי להראות מה באמת הושווה במקור, במקום להצמיד את המספרים לשם אחר.

מחירי API: קלט ופלט מחויבים בנפרד

הטבלה מרכזת את מחירי הבסיס בדולרים למיליון טוקנים, לפי מחירון Anthropic ביום הבדיקה. היא אינה כוללת כלים, מטמון, עיבוד באצוות או מצבי תמחור מיוחדים.

דגםקלט: דולר למיליון טוקניםפלט: דולר למיליון טוקנים
Fable 5.11050
Opus 5525
Sonnet 5210
Haiku 4.515

מחירי קריאה מהמטמון שונים בין דגמים, וגם כתיבה למטמון יכולה להיות רכיב חיוב. לפני אומדן למערכת פעילה, בדקו את השורות המתאימות במחירון ואת נתוני השימוש בפועל.

מנוי לצ׳אט אינו אותה רכישה כמו שימוש ב-API. גם קורס הדרכה הוא מוצר נפרד ואינו משלם עבור חשבון Anthropic. ההבחנה הזאת חשובה כשמתכננים תקציב או משווים הצעת מחיר לפיתוח.

דוגמת חישוב: כמה עולות אלף בקשות

זו דוגמה חשבונית להמחשה בלבד, ולא מדידה של לקוח או תחזית שימוש. נניח שבקשה ל-Opus 5 כוללת 2,000 טוקני קלט ומחזירה 500 טוקני פלט, בלי כלים ובלי מטמון.

עלות הקלט היא 2,000 חלקי מיליון, כפול 5 דולר: 0.01 דולר. עלות הפלט היא 500 חלקי מיליון, כפול 25 דולר: 0.0125 דולר. יחד מתקבלים 0.0225 דולר לבקשה, או 22.50 דולר לאלף בקשות כאלה.

במערכת אמיתית יש למדוד את כלל הטוקנים המחויבים, כולל חשיבה כאשר היא מחויבת, היסטוריית השיחה והרצות חוזרות. אם דוגמת ההנחה כוללת רק את הטקסט הגלוי, היא עשויה להחסיר צריכה. הוסיפו גם עלויות חיצוניות כגון חיפוש, אחסון ותשתית אם הן קיימות בתהליך.

דרך שימושית להשוות היא לחשב עלות לתוצר שאושר: סך עלויות ההרצות חלקי מספר התוצרים שעברו את הבדיקה. כך ניסיון שנכשל אינו נעלם מהחשבון.

עבודת ידע ושימוש במחשב

תוצרים, אוטומציה ועבודה במחשב
מבחןClaude Fable 5.1Claude Fable 5Claude Opus 5
GDPVal-AA v2דירוג עבודת ידע185317231824
OSWorld 2.0 · Partialניקוד חלקי · אוגוסט 202677.9%72.9%75.4%
OSWorld 2.0 · Strictהשלמה מלאה · אוגוסט 202641.7%36.1%39.6%
AutomationBenchתהליכים עסקיים31.4%17.1%26.9%
מקור: מסמך התוצאות הרשמי · נבדק ב־09.09.2026

טבלת Anthropic מספטמבר 2026. גבוה עדיף; אלה תוצאות ההשוואה שפרסם היצרן, לא תנאים אחידים שהרצנו. Fable נבדק עם מנגנוני ההגנה של המוצר: בסירובי סייבר הופעל Opus 4.8 ובביולוגיה Opus 5, למעט החריגים המפורטים. הטבלה מתייחסת ל־Fable, לא לגרסת Mythos עם הגנות אחרות. OSWorld 2.0 משתמש במשימות אוגוסט 2026 ובמדידה מחדש לכל שלושת המודלים: Partial מעניק ניקוד חלקי; Strict דורש השלמה מלאה. אין להשוות לציוני יולי. בסירוב, שני דגמי Fable מקבלים אפס ב־OSWorld ו־Fable 5 מקבל אפס ב־AutomationBench. GDPVal-AA הוא דירוג, לא אחוז.

כרטיס בדיקה לפני בחירת דגם

רשמו מראש את הפרטים הבאים. הם יעזרו להבין אם צריך להחליף מודל, לשפר מקור מידע או פשוט לחדד הוראות.

פרטמה לרשום
תוצרלמשל: סיווג פנייה לאחת מחמש מחלקות
תנאי קבלהקטגוריה חוקית, ללא המצאת מידע, מסלול לאי־ודאות
חומר בדיקהפניות מייצגות לאחר הסרת פרטים לא נחוצים
זמןזמן עד תשובה שימושית, כולל תיקונים
עלותשימוש מדוד בכלל ההרצות
תקלותמה נכשל, באיזו תדירות ומה הייתה ההשפעה
אחריותמי בודק חריגים ומי יכול לעצור פעולה

אין צורך לבנות בדיקה גדולה כדי לערוך הודעה בודדת. לעומת זאת, מערכת שעונה ללקוחות או מפעילה כלים צריכה כיסוי של מקרים רגילים ושל חריגים. מדריך בחירת מודל ומאמץ מפרט איך לבצע השוואה כזאת בלי לשנות כמה גורמים בבת אחת.

קלוד מכין כרטיסי משימה זהים לבדיקת כמה דגמים
בחירת דגם מתחילה בכרטיס בדיקה אחד שחוזר בכל ההרצות.

מודלים ותיקים: לבדוק זמינות לפני שדרוג

דוגמה: שני שלבים בטיפול בפנייה אחת

נניח שפנייה נכנסת כוללת בקשה להצעת מחיר ושאלה על חיבור למערכת קיימת. בשלב הראשון צריך לחלץ שם, פרטי קשר ונושאי הפנייה. בשלב השני צריך להכין שאלות לאפיון על סמך המידע שנמסר. השלב הראשון מוגדר וקל יחסית לבדיקה; השני עשוי לדרוש הבנת קשרים ומידע חסר. אפשר לבחון דגם אחד לשניהם, או להפריד אם יש יתרון שניתן להסביר ולמדוד.

לבחור את התוצר לפני שמחליטים על הדגם

הגדירו תחילה מה העובד אמור לקבל: רשומה מסודרת, טיוטת תשובה או רשימת שאלות. אם המטרה היא רק לאתר פרטי קשר מפורשים, תשובה ארוכה על אסטרטגיית מכירות אינה מועילה. אם המטרה היא להבין היקף פיתוח, חילוץ השדות לבדו אינו מספיק. בחירת דגם מתקדמת יותר לא מתקנת חוסר בהירות לגבי המוצר שהמערכת צריכה להפיק.

להגדיר מסלול לפנייה שאינה מתאימה לתבנית

לקוח יכול לכתוב שאין לו עדיין מערכת, לצרף כמה צרכים או לבקש לדבר עם אדם. אל תכריחו את כל הפניות לתוך אותה קטגוריה. אפשר לשמור את המידע הברור ולסמן שאלה פתוחה. אם שלב נוסף דורש מודל אחר או בדיקה אנושית, העבירו אליו גם את הטקסט המקורי ואת ההחלטה שכבר התקבלה. סיכום קצר מדי עלול למחוק את הסיבה שבגללה הפנייה נחשבה חריגה.

לבדוק שהפיצול באמת עוזר

שימוש בכמה דגמים מוסיף חיבורים, הגדרות ומצבי כשל. אם התהליך פשוט, ייתכן שדגם אחד יהיה קל יותר לתחזוקה גם אם מחיר הטוקן שלו מעט גבוה יותר. בחנו את התוצר כולו ואת זמן העבודה של הצוות. אין צורך לפצל רק משום שאפשר. הפיצול מוצדק כאשר הוא שומר על האיכות הדרושה ומייצר יתרון ברור בעלות, בזמן או בשליטה על התהליך.

מחיר מטמון והיקף השיחה

עמוד Fable הרשמי מציג ל־5.1 מחיר קריאה ממטמון של 0.25 דולר למיליון טוקנים. זהו רכיב אחר ממחיר הקלט הרגיל. החיסכון בפועל תלוי בכמות הטקסט שנקראת מהמטמון וביתר רכיבי הבקשה. אין להפוך את מחיר המטמון למחיר כללי למיליון טוקנים או להחיל אותו על פלט. בדקו את שדות השימוש שה־API מחזיר ואת תנאי הספק שלכם.

שיחה ממושכת יכולה לכלול היסטוריה, מסמכי מקור ותוצאות כלים. גם כאשר המשתמש כתב רק שאלה קצרה, הקלט שנשלח למודל עשוי להיות ארוך יותר. לכן אומדן לפי מספר המילים שהלקוח הקליד אינו מספיק. אפשר לצמצם מידע שאינו נחוץ, לשמור סיכום עבודה מדויק ולתכנן שליפה של המקורות הרלוונטיים. הצמצום צריך לשמר את ההקשר הדרוש, במיוחד תנאים והחלטות שכבר התקבלו.

מה הטבלאות מספרות על עבודה במחשב

ב־OSWorld מופיעים גם ניקוד חלקי וגם השלמה מלאה. סוכן שביצע חלק מהפעולות עשוי לקבל ניקוד חלקי גבוה, אף שהתהליך לא הסתיים. עבור עסק, צריך להחליט מה נחשב הצלחה: טיוטה מוכנה לבדיקה או פעולה שנשמרה במערכת. ההבחנה הזאת מסבירה מדוע שני ציונים מאותה משפחת מבחנים יכולים להיראות שונים מאוד בלי לסתור זה את זה.

בנוסף, נתוני OSWorld בטבלת Fable נמדדו מחדש על משימות אוגוסט. אין להשוות אותם ישירות לתוצאות יולי של Opus 5 רק מפני שהשם OSWorld 2.0 מופיע בשתיהן. זו דוגמה לכך שגרסת המשימות והפרוטוקול חשובות כמו שם המודל. הקישור למקור וההערות מתחת לטבלה מאפשרים להבין את ההבדל בלי להעמיס את כל מסמך המדידה על רצף הקריאה.

לבדוק את מחזור החיים של הדגם

שם שמופיע במדריך ישן אינו בהכרח זמין היום בחשבון או ב-API שלכם. לפני שינוי במערכת, בדקו את מזהה הדגם ואת דף מחזור החיים והפרישה הרשמי.

שמרו את הגדרת המודל הקודם ואת תוצאות הבדיקות שלו, הריצו את אותם מקרים בדגם החדש ובדקו גם את פורמט התשובה ואת הפעלת הכלים. אם יש תלות בדגם חלופי, בדקו גם אותו בפועל. החלפת שם בקובץ הגדרות אינה בדיקת תאימות.

למי שמחבר מודל לתהליך עסקי, כדאי להתחיל באפיון סוכן AI לעסק: אילו פעולות נחוצות, היכן עובר אישור אנושי ואיך מודדים הצלחה. בחירת הדגם מגיעה כחלק מהתכנון הזה.

בבחירה לשימוש אישי, התחילו במשימה אחת עם חומר שאתם מכירים. בקשו טיוטה, בדקו אותה ושפרו את ההוראה לפני שאתם משנים את הדגם. במערכת שמשרתת צוות, אותה החלטה צריכה לכלול גם מי בודק את התוצרים ואיך מדווחים על כשל. ההבדל בין שני המצבים אינו רק מספר המשתמשים: הוא משפיע על התיעוד, על התקציב ועל הדרך שבה מכניסים שינויים לעבודה שכבר הפכה להרגל.

כדאי לקבוע נקודת בדיקה מחודשת רק כשיש סיבה: דרישה חדשה, עלייה בעלויות, תקלות חוזרות או הודעת פרישה של הדגם. מעקב אחרי כל השקה יכול להיות מעניין ללמידה, אך מערכת עסקית צריכה יציבות והסבר לשינוי. שמרו את תוצאות הבדיקה הקודמת כדי שתוכלו להשוות התקדמות אמיתית במקום להסתמך על זיכרון של תשובה מוצלחת אחת.

שאלות נפוצות

איזה מודל Claude הכי מתאים למתחילים?

בצ׳אט התחילו במודל שזמין בחשבון שלכם ובמשימה מוגדרת. בחירת API היא החלטה אחרת, שכוללת גם עלות ותפעול. אין צורך לקנות את האפשרות היקרה כדי לבדוק אם תהליך בסיסי מתאים לכם.

האם Haiku אינו מתאים לעבודה מקצועית?

שם הדגם אינו קובע אם תוצר מסוים תקין. אם משימה מוגדרת היטב והדגם עובר את בדיקות האיכות שלכם, הוא יכול להיות מועמד. במשימה רגישה או מורכבת אין להסתפק בהתרשמות מתשובה אחת.

האם מחיר API כולל שימוש חופשי בצ׳אט?

לא. אלה מסלולי חיוב שונים. בדקו בנפרד את המנוי ואת חשבון ה-API, ובמערכת קיימת ודאו באילו אישורים היא משתמשת.

האם כדאי להחליף דגם בכל השקה?

רק לאחר בדיקה שמראה יתרון רלוונטי או כשיש צורך תפעולי, כגון פרישת מודל. מדדו איכות, עלות וזמן באותם תנאים לפני העברה של תהליך פעיל.