DeepSeek V4 כוללת את Flash ואת Pro, עם גישה דרך API ואפשרויות של משקולות פתוחות. לפני החלטה על מעבר, בדקו את הגרסה, את הספק ואת תעריף החיוב בפועל. מחירי ההשקה מאפריל 2026 אינם המחירון הנוכחי: באוגוסט נכנס תמחור לפי שעות עומס ושפל.
המידע כאן נבדק ב־8 בספטמבר 2026. המדריך מציע דרך לחשב עלות ולבחון התאמה לתהליך; לא נערך בו מבחן שמוכיח ש-DeepSeek עדיפה על מודל אחר.
אילו גרסאות זמינות ומה השתנה מאז ההשקה
לפי יומן העדכונים של DeepSeek, משפחת V4 הוצגה ב־24 באפריל. Flash עודכנה ב־31 ביולי ו-Pro ב־13 באוגוסט, תוך שמירת מזהי ה-API deepseek-v4-flash ו־deepseek-v4-pro. ב־21 באוגוסט נוספה גם גרסת ראייה ניסיונית נפרדת.
המשמעות היא שמזהה קבוע אינו מבטיח שהגרסה שמאחוריו נשארת זהה. תעדו מועד בדיקה ואת פרטי הגרסה שהספק מפרסם, וחזרו על בדיקות הקבלה אחרי עדכון משמעותי.
כרטיס המשקולות של V4 מתאר שני מודלי MoE: Pro עם 1.6 טריליון פרמטרים ו־49 מיליארד פעילים, ו-Flash עם 284 מיליארד ו־13 מיליארד פעילים. המספרים מתארים את המודל, אך אינם מדד ישיר לאיכות בתהליך שלכם או לעלות של הרצה עצמית.
מבחני הפיתוח בפרסום DeepSeek
| מבחן | DeepSeek V4 Pro 0813 | DeepSeek V4 Flash 0731 | Claude Opus 4.8 |
|---|---|---|---|
| Terminal Bench 2.1עבודה במסוף | 87.9 | 82.7 | 85.0 |
| NL2Repoיצירת מאגר קוד | 61.5 | 54.2 | 69.7 |
| DeepSWEגרסה לא מפורטת במקור | 62.7 | 54.4 | 58.0 |
| DSBench-FullStackמבחן פנימי של היצרן | 71.1 | 68.7 | 71.6 |
כרטיס DeepSeek מאוגוסט 2026. גבוה עדיף; המספרים בסולם המקור, ללא תוספת אחוז. משימות סוכן קוד ציבוריות של DeepSeek: DeepSeek Harness minimal, מאמץ max, טמפרטורה 1, top_p=0.95. פרטי המתחרה אינם מפורטים במלואם בכרטיס; זו השוואת היצרן, לא הרצה אחידה שלנו. DSBench-FullStack הוא מבחן פנימי של DeepSeek. גרסת DeepSWE אינה מצוינת בכותרת המקור, ולכן אין לחבר את השורה לציוני גרסה אחרת.
מחירון API: שעות עומס ושפל
הטבלה מבוססת על המחירון הרשמי. כל המחירים בדולרים למיליון טוקנים, בבדיקה מ־8 בספטמבר 2026.
| מודל ומועד | קלט מהמטמון | קלט ללא מטמון | פלט |
|---|---|---|---|
| Flash בשפל | $0.007 | $0.22 | $0.66 |
| Flash בעומס | $0.014 | $0.44 | $1.32 |
| Pro בשפל | $0.022 | $0.66 | $1.98 |
| Pro בעומס | $0.044 | $1.32 | $3.96 |
שעות העומס הן 01:00–04:00 ו־06:00–10:00 לפי UTC, בימים שני עד שישי; שאר השעות בשפל. אם מתזמנים משימות לפי שעון ישראל, השתמשו בהמרת אזור זמן שמתחשבת בתאריך, ולא בתוספת שעות קבועה לכל השנה.
המחירון מתעד חלון הקשר של 1M ותקרת פלט של 384K. אלה גבולות, לא המלצה למלא כל בקשה עד התקרה. בקשה ארוכה מגדילה עלות וזמן, ויכולה להקשות על איתור המידע הרלוונטי.
דוגמת חישוב לפני החלטה
נניח לצורך המחשה בלבד שתהליך משתמש בחודש ב־10 מיליון טוקני קלט שאינם במטמון וב־2 מיליון טוקני פלט. זו הנחת עבודה, לא נתון שנמדד אצל לקוח.
| תרחיש | חישוב | עלות טוקנים |
|---|---|---|
| Flash, הכול בשפל | 10 × 0.22 + 2 × 0.66 | $3.52 |
| Flash, הכול בעומס | 10 × 0.44 + 2 × 1.32 | $7.04 |
| Pro, הכול בשפל | 10 × 0.66 + 2 × 1.98 | $10.56 |
| Pro, הכול בעומס | 10 × 1.32 + 2 × 3.96 | $21.12 |
בתהליך אמיתי צריך לחשב את תמהיל השעות, המטמון, טוקני החשיבה והניסיונות החוזרים כפי שנרשמו בחיוב. הוסיפו גם עלות תשתית, כלים וזמן בדיקה. מחיר הטוקנים לבדו אינו עלות התוצר המאושר.
לצורך השוואה, קחו את אותו תמהיל ואת תוצאות הקבלה של כל מועמד. אין יחס חיסכון אחיד מול ״כל המתחרים״. טבלת מודלי Claude יכולה לשמש מקור השוואה נוסף, אך צריך לבדוק את מחירה במועד ההחלטה.
מטמון: חשבו לפי שימוש שנרשם
אל תניחו שכל ההוראות הקבועות חויבו במחיר מטמון. בדקו את נתוני השימוש שמחזיר הספק ואת כללי המטמון של המסלול שבו אתם עובדים. שמירה על חלקים קבועים עשויה לעזור, אבל שיעור הפגיעה במטמון הוא נתון שצריך למדוד.
באותה מידה, תשובה ארוכה יותר יכולה למחוק חלק מחיסכון הקלט. הגדירו פורמט ואורך המתאימים למשימה, ושמרו מידע רלוונטי בלבד. אין צורך להזין ארכיון שלם כאשר אפשר לספק מקור ממוקד ונבדק.
אם התהליך רץ באוטומציה של n8n, תעדו את העלות ברמת הביצוע העסקי כולו, כולל קריאות שחזרו לאחר שגיאה. חיוב על ניסיון נוסף אינו אומר שהפנייה טופלה פעמיים בהצלחה.

שימוש בכלים ומשימות סוכן
| מבחן | DeepSeek V4 Pro 0813 | DeepSeek V4 Flash 0731 | Claude Opus 4.8 |
|---|---|---|---|
| Toolathlon-Verifiedשימוש בכלים | 74.1 | 70.3 | 76.2 |
| AutomationBench (Public)תהליכים עסקיים | 31.8 | 25.1 | 27.2 |
| HLE · without toolsללא כלים | 42.7 | 37.8 | 49.8 |
| HLE · with toolsעם כלים | 60.0 | 51.5 | 57.9 |
כרטיס DeepSeek מאוגוסט 2026. גבוה עדיף; המספרים בסולם המקור, ללא תוספת אחוז. משימות סוכן קוד ציבוריות של DeepSeek: DeepSeek Harness minimal, מאמץ max, טמפרטורה 1, top_p=0.95. פרטי המתחרה אינם מפורטים במלואם בכרטיס; זו השוואת היצרן, לא הרצה אחידה שלנו. AutomationBench כאן Public; אין להשוות למאגר held-out או ל־v1.0.6 בלי אימות הפרוטוקול. HLE מוצג בשתי התצורות שהמקור מפריד.
ניסוי התאמה: סיווג פניות בעברית
לפני החלפת מודל, הגדירו קטגוריות ותנאי קבלה. הדוגמה הזו נכתבה למדריך ואינה מתארת מבחן שבוצע:
| סוג פנייה | תוצאה שצריכה לעבור בדיקה |
|---|---|
| בקשה מפורשת להצעת מחיר | סיווג מתאים בלי המצאת מחיר |
| שאלה עם שני נושאים | שימור שני הצרכים או הפניה לבדיקה |
| פנייה חסרת הקשר | סימון מידע חסר |
| טקסט בעברית עם שם מוצר באנגלית | שמירת השם והמשמעות |
| הוראה שמופיעה בתוך חומר הלקוח | אין שינוי של כללי הסיווג |
| תשובה שלא עומדת במבנה | דחייה או טיפול בכשל לפני המשך |
הריצו את אותן דוגמאות על המודל הקיים ועל המועמד. שמרו פרומפט, גרסה, זמן, עלות ותיקונים. אם הפעולה הבאה שולחת הודעה או מעדכנת מערכת, בדקו גם מניעת כפילות ואישור מחוץ למודל.
אפשר להיעזר בשיטת השוואת המודלים כדי לבודד משתנים. שינוי ספק, מודל והוראות בבת אחת מקשה לדעת מה גרם לשיפור או לכשל.
לנהל עבודה ממתינה וניסיונות חוזרים
תכנון תור לעבודה שאפשר לדחות
נניח שהעסק מפיק בכל לילה סיכום של פניות היום. אין צורך שכל הסיכומים יתקבלו מיד עם סגירת המשרד, אבל הם צריכים להיות מוכנים לפני ישיבת הבוקר. במקרה כזה אפשר לתכנן תור עבודה לפי מועד היעד. שמרו עבור כל משימה מזהה, מצב, מספר ניסיונות וזמן אחרון. התור צריך לדעת אילו משימות הסתיימו ואילו דורשות ניסיון נוסף, בלי להפיק שוב תוצרים שכבר אושרו.
להתאים את ההמתנה לשימוש העסקי
לעומת סיכום לילי, תשובה ללקוח שמחכה בצ׳אט אינה מתאימה בדרך כלל לדחייה של שעות רק כדי לנצל תעריף אחר. הגדירו סוגי עבודה שונים: מענה בזמן שיחה, טיוטה לעובד ועיבוד מרוכז. לכל סוג אפשר לקבוע זמן יעד ומסלול כשל. ההפרדה מאפשרת לנצל את מבנה התמחור בלי להפוך את כל המערכת לתלויה בשעה שבה המחיר נמוך יותר.
לחשב גם ניסיון שלא הפיק תוצר
אם בקשה חזרה עם מבנה לא תקין, ייתכן שכבר נוצר חיוב על הטוקנים שבה. שמרו נתוני שימוש לכל ניסיון, וקשרו אותם לאותה משימה עסקית. כך אפשר לראות כמה עלתה הפקת סיכום אחד שאושר, גם אם נדרשו שתי בקשות. אל תכפילו אוטומטית את מספר ההרצות בכל שגיאה; כשל קבוע בפרומפט או בחוזה הממשק לא נפתר בהכרח בניסיון נוסף.
לקבוע מתי מפסיקים ומעבירים לבדיקה
בחרו מגבלה ברורה לניסיונות חוזרים ומצב סיום למשימה שלא הצליחה. העובד צריך לראות מה חסר ולקבל את חומר המקור כדי להשלים את הטיפול. אם המערכת ממשיכה לנסות בלי גבול, עלות קטנה לבקשה יכולה להצטבר והמשימה עדיין לא תסתיים. כלל עצירה הוא חלק מהתכנון התפעולי, ואינו תלוי בכך שהמודל נחשב זול או מהיר יחסית לחלופה.
לפצל מידע קבוע ומידע שמשתנה
בתהליך חוזר יש לעיתים הוראות קבועות, רשימת קטגוריות ומדיניות עסקית, לצד פנייה חדשה בכל בקשה. שמרו את ההפרדה ביניהם בצורה ברורה. היא עוזרת לעדכן מדיניות בלי לערוך ידנית כל פנייה, וגם מאפשרת לבדוק מה נשלח בפועל. שימוש במטמון, אם מתקיים לפי כללי הספק, הוא תוצאה שצריך לראות בנתוני החיוב; אל תתייחסו אליו כהנחה קבועה לכל הטקסט.
אם המדיניות משתנה, שמרו גרסה ותאריך תחולה. סיכום שנוצר אתמול לפי מדיניות קודמת אינו בהכרח שגוי, אך צריך לדעת על מה התבסס. במערכת שירות אפשר לשמור מזהה גרסת הוראות לצד מזהה המודל. התיעוד הקצר הזה עוזר לשחזר שינוי בהתנהגות בלי לשמור בכל רשומה עותק מלא של כל ההוראות והמסמכים.
איך לקרוא את ההבדל בין Flash ל־Pro
הטבלאות מראות יתרונות שונים בתוך משפחת V4, אבל הן אינן קובעות מה נדרש לכל פעולה בעסק. חילוץ שדה מפורש וטיפול במסמך עם סתירות הם משימות שונות. אפשר להתחיל מתהליך פשוט ומוגדר, ולבדוק מתי נדרשת יכולת נוספת. אם בוחרים כמה מודלים, הגדירו את כלל המעבר ביניהם ואת דרך התיעוד, כדי שהפיצול לא יהפוך לקושי חדש בתחזוקה.
שימו לב ששורת מבחן פנימי מתארת נתונים שהיצרן בחר ובדק. היא יכולה לתת הקשר להשקה, אך אינה בסיס לאומדן הצלחה על תהליך אחר. גם בנתונים הציבוריים יש גרסאות שונות של AutomationBench ושל מבחני קוד. לכן השמות והתנאים נשמרים ליד כל טבלה. חיבור מספרים מדפים שונים בלי בדיקת הפרוטוקול עלול לייצר דירוג שנראה מדויק יותר ממה שהראיות מאפשרות.
לבחור בין שירות לתשתית עצמית
בדקו גם מי זמין לטפל בתקלה בשעות שבהן התהליך פועל. מערכת שמסכמת מסמכים בלילה צריכה לשמור תוצאות ביניים ורשימת קבצים שלא הושלמו, כדי שהצוות יוכל להמשיך בבוקר. הודעת שגיאה אחת בלי מזהי מסמכים אינה מספיקה. בין אם משתמשים ב־API ובין אם מתקינים משקולות, כדאי להתחיל ממנגנון התאוששות שאפשר להסביר: מה נשמר, מה בטוח להריץ שוב, ומה מחייב החלטה של אדם לפני המשך העיבוד. אלה החלטות תפעוליות שאף ציון מודל אינו מחליף.
מאגר המשקולות שהוזכר מציין רישיון MIT. הרצה עצמית מחייבת לעמוד בתנאי הרישיון, לתכנן חומרה, לעדכן רכיבי תוכנה ולנהל הרשאות ושמירת נתונים. היא אינה בהכרח זולה יותר משירות API.
בדקו גם את הקשר בין גרסת המשקולות שהורדתם לבין גרסת השירות שעליה קראתם. אין להניח שכל עדכון API הוא בדיוק אותה חבילת משקולות שכבר קיימת אצלכם.
בשירות מתווך, בדקו מי הספק שאליו הבקשה נותבה ובאילו תנאים מעובד המידע. בהרצה עצמית, בדקו גם לוגים, גיבויים וכלים חיצוניים. הבחירה במודל אינה מסיימת את אפיון התהליך העסקי.
למי המדריך והקורס מתאימים
אם אתם צריכים לבחור מודל ל-API, התחילו בחישוב ובניסוי המצומצם. אם הצורך הוא ללמוד ניסוח הוראות, בדיקת תשובות ועבודה עם מסמכים בתוך קלוד, עיינו בסילבוס קורס קלוד. אין כאן הבטחה שהקורס מלמד הקמת תשתית DeepSeek.
שאלות נפוצות
האם DeepSeek V4 זולה פי עשרה?
אין יחס קבוע. המחיר תלוי במודל שמשווים אליו, בתמהיל הטוקנים, בשעות, במטמון ובניסיונות החוזרים. השוו עלות לתוצר שעבר בדיקה.
האם Flash מספיקה לכל סוכן עסקי?
צריך לבדוק לפי המשימות ומקרי החריגה. מחיר נמוך או חלון הקשר גדול אינם הוכחה שהמודל מתאים לפעולה מסוימת.
האם אפשר להמשיך להשתמש בשמות ה-API הישנים?
יומן העדכונים הודיע על הפסקת השמות הישנים ביולי 2026. עדכנו למזהה מתועד ובדקו את מצב החשיבה, הפלט וקריאות הכלים לפני שימוש בתהליך פעיל.
האם כדאי להעביר הכול לשעות השפל?
רק עבודה שאפשר לדחות בלי לפגוע בצורך העסקי. הגדירו זמן יעד וטיפול בכשל, והשוו את החיסכון מול עלות ההמתנה והתחזוקה.


