Claude Opus 5 ומתג ה-Effort: איך לשלוט בעלות של כל משימה שהסוכן מריץ

חסכתי 40% מעלויות ה-AI. בהגדרה אחת.

כשהרצתי 145 מאמרים דרך סוכני Claude Code, כל סוכן קיבל את אותה רמת חשיבה. הסוכן שפירסם לוורדפרס חשב באותו עומק כמו הסוכן שכתב אסטרטגיית תוכן. זה כמו לשלם משכורת מנכ"ל לשליח פיצות.

ב-24 ביולי 2026, Anthropic שחררו את Claude Opus 5. אבל הדבר שהכי שינה לי את המשחק הוא לא הבינה המשודרגת. זה דבר שנקרא מתג ה-Effort (רמת המאמץ). מתג שמאפשר לך להגיד לכל סוכן כמה עמוק לחשוב לפני שהוא עונה.

ברגע שהתחלתי לשבץ כל סוכן לרמה שמתאימה למשימה שלו, צריכת ה-tokens ירדה ברצינות. התוצאות? זהות. במערכת שמייצרת 1,500 קליקים מגוגל ב-28 יום, ההגדרה הזו שווה מאות דולרים בחודש.

מה זה מתג רמת המאמץ ולמה בעל עסק צריך להבין את זה

דמיין שיש לך עובד גאון. הוא יכול לפתור כל בעיה. אבל אם תשאל אותו "מה השעה?", הוא יחשב את מיקום השמש, יבדוק שעוני אטום, ויחזור אחרי שעה עם תשובה מושלמת.

ככה AI עבד עד עכשיו. כל משימה קיבלה אותה רמת מאמץ. "תשנה כותרת"? המודל חשב על זה כאילו ביקשת ממנו לבנות אסטרטגיית שיווק.

מתג ה-Effort מאפשר לך לקבוע כמה עמוק המודל חושב לפני שהוא עונה. ב-Opus 5 יש חמש רמות (דוקומנטציה רשמית):

  1. Low (נמוך): תשובה מהירה, מינימום חשיבה. מתאים לתיקוני טקסט, שינויים קטנים, תרגומים קצרים.
  2. Medium (בינוני): איזון בין מהירות לעומק. כתיבת מיילים, ניתוח קצר, עריכת תוכן. לפי בדיקות שנעשו ב-2026 (ecorpit), זו הרמה הכי יעילה מבחינת עלות מול תועלת.
  3. High (גבוה): ברירת המחדל ב-API. חשיבה רצינית, המודל בודק את עצמו לפני שעונה. מתאים לרוב המשימות הרציניות.
  4. xhigh (גבוה מאוד): עומק חשיבה משמעותי. מתאים לקוד ולמשימות סוכן מורכבות. Anthropic ממליצים על הרמה הזו למי שמריץ סוכני Claude Code.
  5. Max (מקסימום): הכל פתוח. חשיבה מקסימלית, המודל מוודא את התשובה מכמה זוויות. רק למשימות שבאמת דורשות את זה.
למה זה משנה לחשבון שלך

המחיר לכל token נשאר זהה בכל הרמות ($5 למיליון tokens קלט, $25 למיליון tokens פלט). מה שמשתנה הוא כמה tokens המודל צורך. ברמה נמוכה הוא חושב פחות, מייצר פחות tokens של "חשיבה פנימית", ולכן העלות יורדת. Token, אגב, זה יחידת טקסט שהמודל מודד. בערך 4 אותיות באנגלית, קצת פחות בעברית.

המספרים: כמה באמת חוסכים (ואיפה לא)

הנה מה שלמדתי מהמערכת שלי וממה שנמדד בחוץ:

  • Medium הוא המלך. ברוב המשימות, Medium נותן תוצאות קרובות מאוד ל-High עם צריכת tokens נמוכה בהרבה. ברמת Medium, המודל משתמש בערך בחצי מצריכת ה-tokens של High. ההפרש הזה הולך ישר לחשבון שלך.
  • Low לא תמיד חוסך. זו הפתעה: ברמת Low, הסוכן לפעמים עושה יותר ניסיונות ויותר קריאות לכלים, מה שדווקא מעלה את העלות. Low מתאים רק למשימות באמת פשוטות: פרסום, עדכון, שליחה.
  • שיבוץ חכם חותך עשרות אחוזים. כשמשבצים כל סוכן לרמה שמתאימה לו, במקום "רמה אחת לכולם", החיסכון נצבר. במערכת שלי, רוב הסוכנים ירדו מ-High ל-Medium או Low, וה-40% חיסכון הגיע מהצבירה הזו.

החשבון פשוט: אם 80% מהמשימות עוברות מ-High ל-Medium (כמחצית צריכת ה-tokens), ו-20% נשארות על High, החיסכון הכולל מגיע ל-40%. לא תיאוריה. מתמטיקה.

הבזבוז הגדול ביותר ב-AI הוא לא מודל יקר. זה מודל שעובד קשה מדי על דברים קלים.

הטעות שכולם עושים: אותה רמה לכל הסוכנים

אחרי שליוויתי 300+ יזמים ועזרתי לעשרות מהם להטמיע AI בעסק, הנה מה שאני רואה שוב ושוב: הם מריצים את כל הסוכנים על אותה רמה. בדרך כלל High או xhigh. "בטוח שזה יעבוד."

זה כמו לשלם משכורת של מהנדס תוכנה לכל בן אדם בחברה. כולל המזכירה, הנהג, ועובד המחסן. כל אחד מקצוען בתחום שלו, אבל לא כל תפקיד דורש אותו שכר.

הטעות הכי יקרה

אם יש לך 10 סוכנים שעובדים על משימות שונות, וכולם רצים על xhigh… אתה משלם פי 3 ממה שהיית צריך. סוכן שמפרסם תוכן לוורדפרס לא צריך לחשוב ברמת הבינה של סוכן שכותב אסטרטגיית שיווק. תתאים את הרמה למשימה. לא "רמה אחת לכולם".

ככה אני משבץ את הסוכנים שלי (מהמערכת בפועל)

ב-Claude Code, אתה יכול להקצות מודל שונה ורמת Effort שונה לכל סוכן משנה בתוך אותה שיחת עבודה. ב-קובץ CLAUDE.md שלך, אתה מגדיר הוראות שמכוונות כל סוכן לרמה הנכונה.

הנה השיבוץ שעובד לי במערכת התוכן. 145 מאמרים, סוכנים מקבילים, 1,500 קליקים מגוגל בחודש:

שיבוץ Effort לפי תפקיד סוכן

סוכן מתכנן (הסוכן שמנהל את כל השאר): xhigh. הוא חושב, מחליט, מחלק משימות. צריך עומק.

סוכן כותב תוכן: high. כתיבה איכותית דורשת חשיבה, אבל לא מקסימום.

סוכן בודק איכות: xhigh. ביקורת רצינית דורשת עומק דומה לכתיבה.

סוכן מפרסם: low. פרסום לוורדפרס, עדכון CRM, שליחת מייל. ביצוע טכני פשוט.

התוצאה: חיסכון של עשרות אחוזים. אותם מאמרים. אותה איכות.

זו לא תיאוריה. ככה המערכת שלי רצה כל יום. הסוכן שכותב את המאמרים רץ על high. הסוכן שמפרסם אותם רץ על low. הסוכן שבודק את האיכות רץ על xhigh. כל אחד מקבל את הרמה שמתאימה לו.

תקציב משימה: תקרה על כמה עבודה הסוכן עושה

מתג ה-Effort שולט בעומק החשיבה בכל צעד. אבל יש עוד גורם שמשפיע על העלות: כמות הצעדים.

Task Budgets (תקציבי משימה, בגרסת Beta ב-Opus 5, לפי הדוקומנטציה של Anthropic) נותנים לך לקבוע תקרה על כמה עבודה הסוכן עושה בסך הכל. זה כמו להגיד לעובד: "יש לך תקציב קבוע לפרויקט. תעשה את המקסימום בתוך המסגרת."

  • Effort (רמת מאמץ) = כמה עמוק הסוכן חושב בכל צעד בודד.
  • Task Budget (תקציב משימה) = כמה עבודה בסך הכל הסוכן מורשה לעשות.

שני הכלים ביחד נותנים שליטה כפולה. אתה קובע גם כמה עמוק הסוכן חושב, וגם כמה עבודה כוללת הוא עושה. ככה אתה שולט בשני הגורמים שמשפיעים על העלות.

5 כללים לניהול עלויות סוכני AI

אחרי חודשים של הרצת סוכנים על מערכת האוטומציה שלי:

  1. Medium הוא ברירת המחדל שלך. לא High, לא xhigh. תתחיל ב-Medium ותעלה רק אם התוצאה לא מספיקה. רוב בעלי העסקים עושים הפוך. מתחילים ב-xhigh כי "מה כבר יכול להשתבש". זה כמו לשכור מנכ"ל כדי לשלוח פקס.
  2. Low רק למשימות באמת פשוטות. פרסום, עדכון, שליחה. אם המשימה דורשת חשיבה כלשהי, Low עלול דווקא לעלות יותר כי הסוכן ינסה שוב ושוב.
  3. סוכנים שונים, רמות שונות. הסוכן שמתכנן? xhigh. הסוכן שמבצע? Low או Medium. תתאים רמה למשימה, לא "רמה אחת לכולם".
  4. מדוד לפני שמשנה. לפני שאתה מוריד Effort, בדוק אם התוצאה באמת נפגעת. לפעמים Medium נותן תוצאות זהות ל-High. ואתה משלם יותר על כלום.
  5. תבדוק פעם בחודש. תסתכל על צריכת ה-tokens. אילו משימות צרכו הכי הרבה? האם הרמה שנתת להן שווה את ההפרש? לפעמים התשובה מפתיעה.

AI הוא עובד. הגיע הזמן לנהל אותו ככה.

ב-2025, טובי לוטקה, CEO של Shopify, שלח מזכר לכל עובדי החברה: "תוכיחו שלא אפשר לעשות את זה עם AI לפני שמבקשים לגייס בן אדם נוסף" (Entrepreneur).

Claude Opus 5, עם מתג ה-Effort ותקציבי משימה, מסמן את הצעד הבא: גם כשה-AI כבר עובד בשבילך, אתה צריך לנהל אותו כמו עובד. כמה הוא חושב, כמה הוא עובד, וכמה הוא עולה לך. בלי ניהול, הוא שורף תקציב. עם ניהול, הוא חוסך.

בסדנת Claude Code אנחנו בונים מערכות כאלה ביחד. צעד אחרי צעד. כולל הגדרות Effort, שיבוץ סוכנים, ושליטה מלאה בעלויות. אם אתה כבר מריץ סוכנים ורוצה לחסוך, או שאתה רק מתחיל ורוצה לעשות את זה נכון מהיום הראשון… שם המקום.

באהבה ענקית,
יהב.

רוצה שמערכת AI שלמה תעבוד בשבילך?

300+ יזמים כבר בנו עסקים דיגיטליים עם מערכות שעובדות 24/7, מייצרות לקוחות ותוכן, ולא שורפות תקציב. בבדיקת ההתאמה נבין ביחד איך לבנות את זה גם לעסק שלך.

לבדיקת התאמה ›

הזמנה אישית להצטרפות לרשימת התפוצה של יהב

תכניס את המייל שלך בטופס כאן למטה,
וקבל כרטיס מתנה פנימה

אולי יעניין אותך גם...

קייסטאדי חצי מליון שקל בחודש

קייסטאדי במתנה!

איך גרמנו לג׳ני קפלן להפסיק למכור פגישות והקפצנו אותה מ-2,000 שקל בחודש עם יומן מלא ולשון בחוץ…

למעל ל-500,000 שקל בחודש בזמן שהיא סוגרת חופשות מפנקות מסביב לעולם עם כל המשפחה, על ידי שימוש ב- AI וקורסים דיגיטליים.

תנו לי 37 דקות ואני אגלה לכם את הדרך להפסיק למכור זמן - ולהתחיל למכור ידע!