Muse Spark 1.3 הוא מודל של Meta לעבודה עם קוד וסוכנים. הוא הוכרז ב־2 בספטמבר 2026 וזמין לפי Meta ב־Muse Code וב־Meta Model API. ההכרזה הרשמית היא המקור לתיאור ההשקה.

המדריך מבוסס על פרסומים ותיעוד שנבדקו ב־8 בספטמבר. הוא מפריד בין יכולת המודל, נתוני הערכה שפורסמו והרשאות המערכת שמפעילה אותו.

מה אומת בתיעוד

בדף הספק מופיעים מזהה המודל meta/muse-spark-1.3, חלון הקשר של 1,048,576 טוקנים ותמיכה בכלים ובפלט JSON. חלון גדול מאפשר להעביר חומר רב, אך אינו מבטיח שכל הפרטים ישמשו נכון בתשובה. גם קריאה לכלים דורשת יישום שמחבר אותם למודל ובודק את הבקשות.

הדף מתאר קלט רב־מודלי ומציין מגבלה לגבי תמיכה בקלט אודיו ואיכות התוצאה. לכן לא נכון לבחור בו לתהליך תמלול עסקי רק משום שמופיעה אפשרות להזין אודיו. למטרה הזאת צריך ניסוי על ההקלטות והשפה הרלוונטיות.

Muse Spark דרך API אינו זהה למוצר שיחה מסוים של Meta, וחשבון באפליקציה אחרת אינו מבטיח גישה לאותו דגם דרך ספק API. אם המטרה היא לפתח סוכן, בדקו את מזהה המודל שמופיע בתשובה ואת התכונות הנתמכות במסלול שבו בחרתם.

מחיר ומה הוא כולל

בתאריך הבדיקה הוצגו ב־OpenRouter מחירים של 1.25 דולר למיליון טוקני קלט ו־4.25 דולר למיליון טוקני פלט, ו־0.15 דולר לקלט ממטמון. אלה תעריפי הספק לדגם הזה, לא מחיר מנוי ולא הצעה לפיתוח סוכן. דף המחיר והיכולות הוא המקום לבדיקה חוזרת לפני חיבור.

לצורך חישוב בלבד, בקשה עם 2,000 טוקני קלט ו־500 טוקני פלט, ללא מטמון, עולה 0.004625 דולר בתעריפים האלה. בפועל, חשיבה, אורך תשובה וניסיונות חוזרים עשויים לשנות את הצריכה. זהו חישוב תעריף לדוגמה בלבד.

מסלול Contributor, אם מוצע בחשבון, הוא וריאנט נפרד עם תנאים משלו. אין לבחור בו רק מפני שמופיע מחיר אחר, או להניח שמדיניות הטיפול במידע זהה. בדקו את תנאי המסלול, הספק והיישום לפני שימוש בחומר עסקי.

לפי תיעוד המידע של OpenRouter, הגדרות שמירת תוכן ונתוני שימוש הן נושאים נפרדים. גם מדיניות הספק שמריץ את המודל רלוונטית. יש לבדוק את מדיניות הספק לפני שליחת מסמכים עסקיים.

מה פורסם על הבנצ׳מרקים

מסמך מתודולוגיית ההערכה של Meta מתייחס ל־Spark 1.3 ברמת חשיבה max. הוא מפרט מבחני קוד, עבודת ידע ושימוש במחשב, עם הבדלים בין גרסאות, סביבות וכלי ההערכה.

בהכרזה Meta מדווחת גם על כ־20% פחות קריאות לכלים וכ־25% פחות טוקנים בהשוואות שערכו מהנדסיה מול Spark 1.2. אלה נתוני יעילות פנימיים של היצרן; הם אינם ציון איכות כללי או הבטחה לחיסכון במערכת אחרת.

כשאין ציון מספרי מאומת לאותו מבחן ותצורה, אין בסיס להוסיף את המודל לדירוג. אין להשתמש בתוצאה של Spark 1.2 כאילו נמדדה ב־1.3.

יכולות המודל והרשאות המערכת

סוכן צריך יותר ממודל: חיבור לכלים, גישה לתיקיות או למערכות יעד וכללים לביצוע פעולות. תמיכה בקריאה לכלים אינה אישור לשלוח הודעה, לשנות רשומה או לבצע רכישה.

הגדירו אילו פעולות מותר לבצע, אילו דורשות אישור ומה קורה כשהחיבור נכשל. אם משימה לא נשמרה במערכת היעד, אין להציג אותה כהושלמה. שמרו מזהה פעולה ומצב ברור כדי שאפשר יהיה לטפל בתקלה בלי ליצור כפילות.

Muse Code הוא מוצר פיתוח, ואילו API הוא ממשק לחיבור תוכנה. בחירה ביניהם תלויה בדרך העבודה ובמערכות שצריך לחבר, ולא רק בשם המודל.

מעטפות משימה וכרטיס תוצאה ריק לצד יחידת מחשוב מאחורי דלת נעולה
יכולת לבצע משימה אינה הרשאה: הגישה לכלים נקבעת במערכת שמפעילה את הסוכן.

תרגיל מתאים לבדיקת קוד וסוכנים

מעבר למבחן קוד מוגדר, כדאי לבדוק איך המודל מתמודד עם דרישה שאינה שלמה. לדוגמה: ״עדכן את רשימת הפניות כך שתציג רק פניות פעילות״. המונח ״פעילות״ יכול להתייחס לפניות חדשות, לפניות שלא נסגרו או לפניות שטופלו השבוע. התגובה הרצויה היא לזהות מה חסר לפני בחירת כלל שמשנה את התוצאה.

אחרי שמגדירים ש״פעילות״ הן רשומות בסטטוס new או contacted, אפשר לתת נתוני תרגול עם שלושת המצבים ולבדוק את הפלט. הגדירו גם מה קורה כשסטטוס חסר, וודאו שהקוד לא משנה את נתוני המקור. זו דוגמה לדרישות קבלה, ולא תוצאת בנצ׳מרק של Muse.

לניסוח דרישות כאלה, ראו איך לכתוב פרומפט. מדריך סוכן AI לעסק מסביר כיצד לתרגם בקשה כללית לתהליך, הרשאות ותנאי קבלה.

עבודה שממשיכה אחרי בקשת שינוי

דוגמה מפורטת: שינוי הדרישה באמצע משימה

נרחיב את דוגמת הפניות. בתחילת העבודה ביקשתם להציג רק פניות פעילות, ובהמשך הוספתם שמנהלת הצוות צריכה לראות גם פניות סגורות מהשבוע האחרון. ההודעה השנייה אינה בהכרח מחליפה את הראשונה עבור כל המשתמשים. סוכן צריך לזהות מי מקבל את ההתנהגות החדשה, לשמר את ההגדרה לעובדים האחרים ולעדכן את תוכנית העבודה. זאת דוגמה לבעיה שבה ניהול ההקשר חשוב לא פחות מכתיבת תנאי סינון.

לתעד החלטה במקום להסתמך על זיכרון השיחה

בקשו רשימה קצרה של הכללים התקפים: עובד רואה פעילות בלבד; מנהלת רואה גם סגורות בטווח שהוגדר; פנייה חסרת סטטוס עוברת לבדיקה. אם ההחלטה משתנה, מעדכנים את הרשימה ואת הבדיקות. כך אפשר להבין בהמשך מדוע הרשימה נראית אחרת לכל תפקיד. חלון הקשר גדול מאפשר לספק חומר רב, אך הוא אינו מחליף מסמך החלטות קצר שמבהיר מה נדרש עכשיו.

להבחין בין שאלה על העבודה לבקשת שינוי

אם תשאלו ״ומה עם פניות סגורות?״, ייתכן שאתם מבקשים הסבר על המצב הקיים. זו אינה הוראה אוטומטית להציג את כולן. דוגמת שימוש טובה כוללת גם שאלות כאלה ומגדירה שהסוכן יברר כוונה כשיש שינוי משמעותי. התנהגות מקצועית אינה נמדדת רק בכמות הפעולות שבוצעו, אלא גם בשמירה על ההחלטות שכבר אושרו ועל ההפרדה בין בירור לביצוע.

לקבל תוצר שמציג מה נבדק

בסיום, בקשו לראות את המסך עבור עובד ועבור מנהלת, עם רשומות בדיוניות בכל אחד מהמצבים. צרפו מקרה בקצה טווח הזמן כדי להבהיר מה פירוש ״השבוע האחרון״: שבעה ימים אחורה או שבוע קלנדרי. ההגדרה צריכה להיות אותה הגדרה בממשק ובשרת. זהו תרחיש עבודה מוצע; אין כאן טענה ש־Muse Spark ביצע אותו או קיבל עליו ציון.

איך לקרוא טענות על משימות ארוכות

הדגש של Meta בהכרזה הוא על עבודה שנמשכת לאורך כמה שלבים ועל שיתוף פעולה עם המשתמש. כדי להבין את הרלוונטיות אליכם, תארו את התוצר הסופי ואת החלטות הביניים. בניית מסמך מתוך כמה קבצים, למשל, דורשת גם לברר סתירות ולשמור על גרסאות. משימה כזאת שונה משאלה קצרה עם תשובה אחת, ולכן גם דרך הסקירה צריכה להתייחס לשלבים שבהם המידע משתנה.

כדאי שהמערכת תציג מצב עבודה ברור: אילו קבצים נקראו, איזה תוצר נוצר ומה חסר להשלמה. אם חיבור לכלי נכשל, המשתמש צריך לדעת מה נשמר ומה לא. אין צורך להציף אותו בכל קריאה פנימית; עדכון טוב מסביר התקדמות והשלכה על התוצאה. בפרויקט עסקי, היכולת להבין היכן העבודה נעצרה חשובה במיוחד כאשר אדם אחר אמור להמשיך ממנה.

מה נשאר פתוח בנתוני ההשקה

במקורות Meta שנפתחו לצורך הסקירה אותרה מתודולוגיה, אך לא טבלת ציונים מספרית מלאה שאפשר להעתיק לכל המדדים. לכן אין כאן שלוש טבלאות מלאות בציונים לא מאומתים. הקישור למסמך מאפשר להבין אילו יכולות נבדקו, ונתוני היעילות שבהכרזה מסומנים כמדידות פנימיות. כשיש תוצאה מספרית של ספק אחר, צריך לבדוק את גרסת המבחן ואת תנאיה לפני הוספתה להשוואה.

הבחירה הראשונית יכולה בכל זאת להתקדם: בדקו אם הממשק הרצוי זמין, אם קיימים הכלים הנדרשים ואם מסלול המידע מתאים לפרויקט. לאחר מכן הגדירו בדיקת קבלה מצומצמת עם תקציב מאושר, אם השירות מחויב בתשלום. אל תעבירו מערכת פעילה רק כדי להשתמש בשם החדש ביותר. שינוי מודל צריך לפתור צורך מוגדר, ולהשאיר אפשרות לחזור לתצורה שעבדה קודם.

למסירה מסודרת, בקשו את התוצר עצמו ואת מגבלותיו, ולא רק תיאור של הפעולות שהסוכן התכוון לבצע. אם נוצר דוח, פתחו אותו ובדקו שמות, טבלאות וקישורים. אם נכתב קוד, בדקו אותו בתוך היישום. משימה ארוכה יכולה להכיל שלבים רבים שנראו מוצלחים, ועדיין להסתיים בקובץ שאינו נפתח או בדרישה שלא יושמה.

שמרו לצד התוצר את ההחלטות שהתקבלו במהלך השיחה. זה מאפשר להמשיך את העבודה גם בסביבה אחרת, בלי להסתמך על כך שכל ההיסטוריה תישאר זמינה או תיקרא מחדש. התיעוד יכול להיות קצר: מטרה, דרישות תקפות, קבצי מקור והנקודה שבה נעצרה העבודה.

שאלות נפוצות

האם Muse Spark 1.3 עדיף על GPT או Claude?

אין תשובה כללית. השוו רק נתונים שמודדים אותה יכולת בגרסה ובתצורה מזוהות. מדריך ההשוואה לעסק מסביר איך לקרוא את המקורות ואיך להפריד בין ציון קוד, איכות מסמכים ועלות.

האם הוא יכול לבצע משימות לבד?

המודל יכול להשתתף בתהליך שמפעיל כלים, אבל צריך לספק לו אותם ולהגדיר הרשאות, טיפול בכשלים ואישור לפעולות מחייבות. שם הדגם אינו תחליף לפיתוח המערכת שמסביבו.

מה לבדוק לפני חיבור לנתוני עסק?

גישה תקינה, תנאי מידע, כלים נדרשים, פורמט תשובה ומקרי כשל. אם אתם בוחנים סוכן מותאם, אפשר להגדיר יחד את התהליך ואת בדיקות הקבלה, ואז לבחור מודל לפי הממצאים.