מדריך קלוד קוד בעברית

תיעוד 82

ניהול עלויות בצורה יעילה

מעקב אחר שימוש באסימונים (tokens), הגדרת מגבלות הוצאה לצוות, והפחתת עלויות Claude Code באמצעות ניהול הקשר (context), בחירת מודלים, הגדרות חשיבה מורחבת (extended thinking) ו-hooks לעיבוד מקדים.

החיוב ב-Claude Code מתבצע לפי צריכת אסימוני API. לתמחור תוכניות מנוי (Pro, Max, Team, Enterprise), ראה claude.com/pricing. העלויות למפתח משתנות במידה רבה בהתאם לבחירת המודל, גודל בסיס הקוד (codebase), ודפוסי שימוש כגון הרצת מופעים מרובים או אוטומציה.

בפריסות ארגוניות, העלות הממוצעת היא כ-13$ למפתח ליום פעיל וכ-150 עד 250$ למפתח לחודש, כאשר העלויות נשארות מתחת ל-30$ ליום פעיל עבור 90% מהמשתמשים. כדי להעריך את ההוצאה עבור הצוות שלך, התחל עם קבוצת פיילוט קטנה והשתמש בכלי המעקב שלהלן כדי לבסס קו בסיס לפני פריסה רחבה יותר.

דף זה מכסה כיצד לעקוב אחר העלויות שלך, לנהל עלויות עבור הארגון שלך, ולהפחית את השימוש באסימונים.

#מעקב אחר העלויות שלך

#שימוש בפקודה /usage

הערה: בלוק ה-Session ב-/usage מציג שימוש באסימוני API ומיועד למשתמשי API. עבור מנויי Claude Max ו-Pro השימוש כלול במנוי שלהם, כך שנתון עלות ההפעלה אינו רלוונטי לצורכי חיוב. מנויים רואים באותו מסך פסי שימוש בתוכנית, נתוני פעילות, ופירוט שימוש.

בלוק ה-Session בחלק העליון של /usage מציג נתוני שימוש מפורטים באסימונים עבור ההפעלה הנוכחית שלך. Claude Code מחשב את הסכום הדולרי באופן מקומי מספירת האסימונים לפי מחיר המחירון, אלא אם כן טבלת modelPricing נמצאת בתוקף. מנהל מערכת מגדיר טבלה כזו בהגדרות המנוהלות של הארגון שלך כך שהסכום ישתמש בתעריפים שנקבעו בחוזה שלך, ובזמן שטבלה כזו בתוקף, שורת Total cost כוללת את ההערה at your organization's configured rates. הנתון הוא הערכה, לכן לחיוב מוסמך ראה את דף ה-Usage ב-Claude Console.

Total cost:            $0.55
Total duration (API):  6m 20s
Total duration (wall): 6h 33m 10s
Total code changes:    0 lines added, 0 lines removed
Usage by model:
   claude-sonnet-4-6:  1.2k input, 5.3k output, 940.0k cache read, 50.0k cache write ($0.55)

סיכומי סכומים אלה מתאפסים כאשר /clear מתחיל הפעלה חדשה, כך שהעלות הכוללת של ההפעלה הבאה מתחילה ב-0$. לפני גרסה v2.1.211, הם המשיכו להצטבר לאורך פקודות /clear לכל אורך חיי התהליך של Claude Code.

עבור תגובה מ-Claude API המחויבת לפי תעריף של פי 1.1 של תאימות מיקום נתונים (data residency), Claude Code מכפיל את מחיר המחירון של אסימוני אותה תגובה ב-1.1 בנתון עלות ההפעלה. Claude Code מדווח על אותו סכום כולל בשדה העלות של שורת המצב ומשווה אותו עם --max-budget-usd. לפני גרסה v2.1.239, Claude Code לא החיל את ההכפלה ב-1.1 על תגובות אלו, ולכן נתון עלות ההפעלה היה נמוך יותר מהחשבון בפועל.

#נתוני מטמון הנחיות (Prompt cache)

לאחר תגובת ה-API הראשונה של השיחה הראשית, Claude Code מוסיף גם שורת Prompt cache (main) לבלוק ה-Session, המסכמת את השימוש ב-מטמון הנחיות (prompt cache) בהפעלה: מספר הבקשות, שיעור אסימוני הקלט שסופקו מהמטמון, החטאות מטמון (cache misses), והאם המטמון חם כרגע. דורש את Claude Code בגרסה v2.1.251 ומעלה.

Prompt cache (main):   14 requests · 91% of input tokens from cache · 2 misses (last 6m 10s ago, 310.2k tokens re-cached) · 1 expected rebuild (compaction or tool-result clearing) · warm (1h TTL, last activity 40s ago)

החלקים של החטאות, בנייה מחדש צפויה, ומצב חם או קר בשורה זו משמעותם כדלקמן:

  • החטאות (Misses): בקשות שעיבדו מחדש תוכן שהמטמון כבר החזיק, יחד עם זמן ההחטאה האחרונה וכמה אסימונים בקשות אלו כתבו בחזרה למטמון. Claude Code סופר בקשה כהחטאה כאשר הבקשה עיבדה מחדש יותר מ-5% ולפחות 2,000 אסימונים ממה שיכלה לקרוא מהמטמון. הדף פעולות שמבטלות את תוקף המטמון מפרט את הסיבות הנפוצות. כאשר Claude Code מזהה סיבה סבירה להחטאה האחרונה, השורה מציינת גם אותה, למשל likely cause: tool definitions changed. טקסט הסיבה הסבירה דורש את Claude Code בגרסה v2.1.260 ומעלה.
  • בנייה מחדש צפויה (Expected rebuilds): כאשר Claude Code בעצמו שכתב זה עתה את השיחה, באמצעות דחיסה (compaction) או על ידי ניקוי תוצאות כלים ישנות מההקשר, הוא סופר את אותו סוג של החטאה כבנייה מחדש צפויה במקום זאת. חלק זה מופיע רק לאחר שהתרחשה לפחות בנייה מחדש צפויה אחת.
  • חם או קר (Warm or cold): האם הקידומת שבמטמון עדיין נמצאת בתוך משך חיי המטמון, יחד עם ה-TTL שבתוקף. כאשר המטמון קר, השורה מציגה כמה זמן ההפעלה הייתה במצב סרק. כאשר שום תגובה לא דיווחה על אסימוני מטמון, השורה מסתיימת ב-no prompt caching reported by the API במקום זאת.

הספירות מגיעות משדות אסימוני המטמון בתגובות ה-API, כך שהשורה פועלת בכל ספק ושער (gateway). היא מכסה את השיחה הראשית בלבד, ולא תתי-סוכנים (subagents). הפקודה /clear מאפסת אותה יחד עם שאר בלוק ה-Session.

סקריפטים של שורת המצב יכולים לקרוא את אותם מספרים מתוך האובייקט prompt_cache.

#פירוט שימוש בתוכנית

בתוכניות Pro, Max, Team, או Enterprise, הפקודה /usage מציגה גם פירוט של מה שנחשב כנגד מגבלות התוכנית שלך:

  • ייחוס (Attribution): שימוש אחרון המיוחס למיומנויות (skills), תתי-סוכנים (subagents), תוספים (plugins), ושרתי MCP בודדים, שכל אחד מהם מוצג כאחוז מתוך הסך הכולל. חלקו של שרת MCP סופר רק את הבקשות שצרכו את אחת מתוצאות הכלים שלו. לפני גרסה v2.1.222, לאחר קריאה אחת לשרת MCP, Claude Code ייחס כל בקשה עוקבת לאותו שרת, מה שהציג את חלקו בהגזמה.
  • סימוני התנהגות (Behavior flags): התנהגויות כגון הקשר ארוך או החטאות מטמון, המסומנות כאשר אחת מהן אחראית ל-10% או יותר מהשימוש האחרון.
  • לולאות (Loops): שורה עבור כל אחת ממשימות /loop או משימות מתוזמנות אחרות הכבדות ביותר שרצו לאחרונה, ממוינות לפי סך האסימונים, יחד עם ספירה של שאר המשימות. Claude Code מדווח באיזו תדירות כל משימה מופעלת, כמה פעמים היא רצה, סך האסימונים שלה ובכל ריצה, ומתי היא רצה לאחרונה. Claude Code מזהה שורה לפי הנחיית המשימה, כך שלולאה שעצרת ויצרת מחדש נשארת כשורה אחת. דורש את Claude Code בגרסה v2.1.242 ומעלה.

הקש על d או w כדי לעבור בין 24 השעות האחרונות לבין 7 הימים האחרונים. הנתונים מקורבים ומחושבים מתוך היסטוריית ההפעלות המקומית במכונה זו, ולכן שימוש ממכשירים אחרים או מ-claude.ai אינו נכלל.

ב-הרחבת VS Code, חלקי הייחוס וסימוני ההתנהגות מופיעים בתיבת הדו-שיח Account & usage עם מתג Day ו-Week, ללא שורות ה-Loops. דורש את Claude Code בגרסה v2.1.174 ומעלה.

#בדיקת הוצאות של קרדיטי שימוש (usage credits)

הפקודה /usage מציגה גם שורת usage-credits כאשר קרדיטי שימוש (usage credits) מופעלים. מה שמוצג בשורה תלוי בתוכנית שלך:

  • Pro ו-Max: ההוצאה שלך לחודש הנוכחי, הנמדדת מול מגבלת ההוצאה החודשית שלך אם הגדרת כזו. כאשר לא הגדרת מגבלה, השורה מציגה Unlimited ללא נתון הוצאה.
  • Team ו-Enterprise: ההוצאה האישית שלך לחודש הנוכחי, הנמדדת מול כל מגבלה שהארגון שלך הגדיר שחלה עליך. מגבלה שמכסה את כל הארגון אינה מופיעה בשורה. כאשר אין לך מגבלה משלך, השורה מציגה את ההוצאה שלך ללא מגבלה לצידה. בזמן שקרדיטי שימוש כבויים עבורך, /usage אינו מציג שורת usage-credits.

כאשר מוגדרת לך מגבלת הוצאה, השורה מופיעה ברגע שקרדיטי שימוש מופעלים ומציגה 0% עד שתוציא לראשונה קרדיטי שימוש. לפני גרסה v2.1.236, הפקודה /usage הציגה את השורה רק בתוכניות Pro ו-Max, ושורה עם מגבלת הוצאה נשארה מוסתרת עד שהוצאת משהו.

#כאשר הבקשה לנתוני שימוש נכשלת

כאשר הבקשה למגבלות התוכנית שלך נכשלת, לרוב בגלל שמגבלת הקצב (rate limit) של נקודת הקצה (endpoint) לשימוש הופעלה, /usage מציג את פסי השימוש האחרונים שנטענו במכונה זו במהלך 60 הדקות האחרונות, יחד עם הערה Showing last-known usage המציינת לפני כמה זמן נתונים אלה נשלפו. הקש על r כדי לנסות שוב. ניסיון חוזר מוצלח מחליף את הפסים הידועים האחרונים בנתונים עדכניים. ללא תמונת מצב מ-60 הדקות האחרונות, /usage מדווח שנקודת הקצה של השימוש מוגבלת בקצב ומציע את אותו קיצור דרך לניסיון חוזר. לפני גרסה v2.1.208, בקשה שהוגבלה בקצב בהפעלה שעדיין לא טענה נתוני שימוש הציגה תמיד את השגיאה ללא פסים.

#ניתוח דפוסי השימוש שלך

הפעל את /insights לקבלת דוח על אופן העבודה שלך במקום על כמות האסימונים שהשתמשת בהם. הפקודה מנתחת את ההפעלות האחרונות שלך במכונה זו וכותבת דוח HTML המכסה את מה שאתה עובד עליו, נקודות חיכוך כגון בקשות שלא הובנו כהלכה או קוד עם באגים, והצעות לשימוש יעיל יותר ב-Claude Code. ריצה בודדת מנתחת עד 200 הפעלות שלא ראתה קודם ומדלגת על הפעלות קצרות מאוד. כאשר הפעלות מושמטות, כותרת הדוח מציגה את מספר ההפעלות שנותחו יחד עם הסך הכולל בסוגריים, למשל 200 sessions (412 total).

Claude Code כותב את הדוח העדכני ביותר אל ~/.claude/usage-data/report.html ושומר עותק עם חותמת זמן של כל ריצה באותה ספרייה, כך שדוחות קודמים אינם נדרסים. Claude Code מוחק דוחות לפי אותו לוח זמנים כמו שאר נתוני ההפעלות שלך: בעת ההפעלה (startup), הוא מסיר קבצים ישנים יותר מ-cleanupPeriodDays, 30 ימים כברירת מחדל.

ניתן להריץ את /insights בכל תוכנית ועם כל ספק. הניתוח פועל דרך אותו ספק ואותו חשבון כמו ההפעלות הרגילות שלך, והאסימונים נספרים כנגד השימוש בתוכנית או ב-API שלך. הפעלות ממכשירים אחרים ומ-claude.ai אינן נכללות.

#הוספת קרדיטי שימוש (usage credits) למנוי שלך

קרדיטי שימוש (Usage credits) מאפשרים לך להמשיך לעבוד מעבר למגבלת השימוש של התוכנית שלך. כדי לנהל אותם, הפעל את /usage-credits לאחר התחברות עם מנוי claude.ai שלך דרך /login. הפקודה אינה זמינה עם אימות באמצעות מפתח API. בארגוני Enterprise בשירות עצמי, תקופות ניסיון של Enterprise, וארגוני Enterprise המחויבים דרך AWS Marketplace, הפקודה דורשת את Claude Code בגרסה v2.1.248 ומעלה. גרסאות מוקדמות יותר דוחות אותה עם השגיאה Unknown command: /usage-credits. מה שנפתח תלוי בתפקיד שלך:

התפקיד שלךמה ש-/usage-credits עושה
מנוי Pro או Maxפותח את Settings > Usage ב-claude.ai בדפדפן. בחלק Usage credits שבו תוכל להפעיל או לכבות קרדיטי שימוש ולבדוק את יתרת הקרדיט שלך, ההוצאה החודש, ומגבלת ההוצאה החודשית שלך
חבר ב-Team או ב-Enterprise עם גישת חיובפותח את הגדרות השימוש של הארגון שלך, Admin settings > Usage, בדפדפן
חבר ב-Team או ב-Enterprise ללא גישת חיובמבקש ממך לאשר, ולאחר מכן שולח בקשה למנהלי המערכת של הארגון שלך. לפני גרסה v2.1.211, Claude Code שלח את הבקשה ללא שלב אישור

עבור חברי Team ו-Enterprise ללא גישת חיוב, האישור מופיע רק בהפעלות אינטראקטיביות: במצב לא-אינטראקטיבי עם הדגל -p ומתוך Remote Control, הפקודה אינה שולחת בקשה ומורה לך להריץ אותה בהפעלה אינטראקטיבית במקום זאת.

אם תפעיל שוב את /usage-credits בזמן שבקשתך הקודמת ממתינה למנהל מערכת, Claude Code יודיע לך שבקשה כבר נשלחה במקום לשלוח בקשה כפולה. לאחר שמנהל מערכת דוחה את בקשתך, הפעלת הפקודה שוב שולחת בקשה חדשה. לפני גרסה v2.1.222, בקשה שנדחתה חסמה גם שליחת בקשות חדשות.

בתוכניות Pro ו-Max, כאשר אתה מגיע למגבלת ההוצאה שלך כאשר קרדיטי שימוש עדיין זמינים, Claude Code מציע לך להעלות או להסיר את המגבלה בלי לעזוב את ה-CLI. אם השרת דוחה את השינוי, ראה Could not update your spend limit.

#ניהול עלויות עבור הארגון שלך

אילו אמצעי בקרה עומדים לרשותך תלוי באופן שבו הארגון שלך ניגש אל Claude Code: תוכנית Claude for Teams או Enterprise, ה-Claude Console, או ספק ענן. בתוכניות Teams ו-Enterprise, השימוש נגרע מהקצאת המושב (seat allowance) של כל חבר. ב-Console ובספקי ענן, השימוש מחויב לפי אסימון לארגון שלך. אם הארגון שלך משלב שיטות התחברות, כל מפתח נמדד לפי השיטה שבאמצעותה הוא הזדהה.

הטבלה ממפה כל תצורה למקום שבו אתה רואה את ההוצאה, המקום שבו אתה מגביל אותה, וכיצד אתה מושך נתונים לפי משתמש. בתוכנית Pro או Max אישית אין לך ארגון לנהל, לכן עקוב אחר הוצאות קרדיטי השימוש שלך, כולל fast mode, תחת הוספת קרדיטי שימוש למנוי שלך.

התצורה שלךצפייה בהוצאותהגבלת הוצאותדיווח לפי משתמש
Claude for Teams או Enterpriseדוח הוצאות בניתוחי הארגון (org analytics)מגבלות הוצאה בהגדרות הניהול (admin settings)קובץ CSV של דוח הוצאות; Enterprise Analytics API ב-Enterprise
Claude Console (API)דף השימוש ב-Consoleמגבלות הוצאה של סביבת העבודה (workspace)לוח בקרה של Console, Claude Code Analytics API
Amazon Bedrock, Google Cloud's Agent Platform, או Microsoft Foundryלוח הבקרה של החיוב בענן שלךבקרות התקציב של הענן שלךOpenTelemetry או שער LLM (LLM gateway)

ייצוא OpenTelemetry עובד בכל תצורה והוא האפשרות היחידה שמזרימה מדדי אסימונים ועלויות לפי משתמש אל מערך הניטור (observability stack) שלך כמעט בזמן אמת.

#דיווח על הוצאות לפי התעריפים שנקבעו בחוזה שלך

כברירת מחדל, Claude Code מחשב כל נתון עלות שהוא מציג למפתחים לפי מחיר המחירון, כך שאם הארגון שלך משלם תעריפים שנקבעו בחוזה, הנתונים ב-/usage, בשורת המצב, וב-OpenTelemetry אינם תואמים לחשבון שלך. כדי להתאים ביניהם, הגדר את ההגדרה המנוהלת modelPricing לפי התעריפים שלך. ההגדרה משנה את מה ש-Claude Code מדווח, ולא את מה ש-Anthropic מחייבת. דורש את Claude Code בגרסה v2.1.242 ומעלה.

  1. קח את התעריפים מהחוזה שלך: הזן את התעריפים למיליון אסימונים מהחוזה שלך. Claude Code אינו שולף אותם מ-Claude Console, לכן עדכן את ההגדרה כאשר החוזה משתנה.
  2. כתוב את ההגדרה: הגדר את multiplier עבור אחוז הנחה אחיד ממחיר המחירון, פרט את ארבעת התעריפים לכל אסימון עבור כל מודל תחת overrides, או בצע את שניהם. הערך של modelPricing כולל את המבנה ודוגמה מוכנה להדבקה.
  3. פרוס אותה דרך הגדרות מנוהלות: ספק אותה בתור הגדרות מנוהלות: הגדרות מנוהלות שרת, מדיניות MDM, הקובץ managed-settings.json, או מסייע מדיניות (policy helper). Claude Code מתעלם מהמפתח בהגדרות משתמש, פרויקט, והגדרות מקומיות, וכן בדגל --settings.

כדי לאשר שהתעריפים בתוקף, הפעל את /usage בהפעלה שקיבלה את ההגדרות המנוהלות: שורת Total cost בבלוק ה-Session נושאת את ההערה at your organization's configured rates. הנתונים הם עדיין הערכות, ולא חשבונית. המחירים למיליון אסימונים בבורר /model נשארים לפי מחיר מחירון.

#Claude for Teams ו-Enterprise

בתוכניות Claude for Teams ו-Enterprise, השימוש של כל חבר ב-Claude Code נגרע מהקצאת מושב שמתאפסת בחלון מתגלגל של חמש שעות ובחלון שבועי. ההקצאה משותפת עם הצ'אט של Claude ועם Cowork, וגודלה תלוי ברמת המושב (seat tier) של החבר (Standard או Premium). אמצעי הבקרה שלך נמצאים בלוח הניהול של claude.ai, ולא ב-Claude Console.

  • צפייה בהוצאות: דוח ההוצאות בניתוחי הארגון מציג הערכת הוצאה לפי משתמש ולפי מודל, עם ייצוא ל-CSV, ומתעדכן מדי יום. הדוח מכסה הוצאות קרדיטי שימוש ומופיע ברגע שקרדיטי שימוש מופעלים. שימוש בתוך הקצאת המושב אינו נמדד בדולרים.
  • צפייה באימוץ: לוח הבקרה של הניתוחים (analytics dashboard) מציג משתמשים פעילים יומיים, הפעלות, ומדדי תרומה, עם ייצוא נתוני תרומה ל-CSV. ראה מעקב אחר שימוש בצוות באמצעות ניתוחים.
  • הגבלת הוצאות: הקצאת המושב היא תקרת ברירת המחדל. כדי לאפשר לחברים להמשיך מעבר לה, הפעל קרדיטי שימוש והגדר מגבלות הוצאה ברמת הארגון, הקבוצה, או חבר צוות בודד.
  • משיכת נתונים לפי משתמש: בתוכנית Enterprise, ה-Enterprise Analytics API מחזיר דוחות שימוש ועלות לפי משתמש בכל ממשקי Claude, כולל Claude Code. בעלים ראשי (Primary Owner) יוצר מפתח עם הרשאת read:analytics ב-claude.ai/analytics/api-keys. בתוכנית Teams, ייצא את קובץ ה-CSV של דוח ההוצאות, המפרט שימוש באסימונים והוצאה משוערת לפי משתמש ולפי מודל.

מדריך הצריכה של Claude Enterprise הוא מדריך התכנון למנהלי מערכת. הוא מסביר כיצד הצריכה שונה בין הצ'אט של Claude, לבין Claude Code ו-Cowork, ומספק נקודות מוצא דולריות לפי משתמש לצורכי תקצוב. תקצב יותר עבור מושב פיתוח קוד מאשר עבור מושב צ'אט: כל תור (turn) ב-Claude Code נושא תוכן קבצים, קריאות לכלים, וחשיבה רב-שלבית, כך שהפעלת ניפוי שגיאות (debugging) אחת יכולה לצרוך יותר מיום שלם של צ'אט.

#Claude Console

ארגוני API מנהלים את הוצאות Claude Code דרך סביבות עבודה (workspaces). באפשרותך להגדיר מגבלות הוצאה לסביבת עבודה על סך ההוצאה ב-Claude Code ולצפות בדיווחי עלויות ושימוש ב-Console.

הערה: כאשר אתה מאמת את Claude Code לראשונה עם חשבון Claude Console שלך, סביבת עבודה בשם "Claude Code" נוצרת עבורך באופן אוטומטי. סביבת עבודה זו מספקת מעקב עלויות וניהול מרוכזים עבור כל השימוש ב-Claude Code בארגון שלך. אינך יכול ליצור מפתחות API עבור סביבת עבודה זו: היא מיועדת אך ורק לאימות ולשימוש ב-Claude Code.

עבור ארגונים עם מגבלות קצב מותאמות אישית, תעבורת Claude Code בסביבת עבודה זו נספרת כנגד מגבלות קצב ה-API הכוללות של הארגון שלך. באפשרותך להגדיר מגבלת קצב לסביבת עבודה בדף Limits של סביבת עבודה זו ב-Claude Console כדי להגביל את חלקה של Claude Code ולהגן על עומסי עבודה אחרים בסביבת הייצור (production).

לדיווח לפי משתמש, לוח הבקרה ב-Console מציג הוצאה ושורות קוד שהתקבלו לפי חבר צוות, וה-Claude Code Analytics API מחזיר את אותם מדדים יומיים לפי משתמש באופן פרוגרמטי באמצעות מפתח Admin API. ראה ניתוחים עבור לקוחות API.

#המלצות על מגבלת קצב (Rate limit)

בעת הגדרת Claude Code עבור צוותים, שקול את ההמלצות הבאות לאסימונים לדקה (TPM) ובקשות לדקה (RPM) למשתמש, בהתבסס על גודל הארגון שלך:

גודל הצוותTPM למשתמשRPM למשתמש
1 עד 5 משתמשים200k עד 300k5 עד 7
5 עד 20 משתמשים100k עד 150k2.5 עד 3.5
20 עד 50 משתמשים50k עד 75k1.25 עד 1.75
50 עד 100 משתמשים25k עד 35k0.62 עד 0.87
100 עד 500 משתמשים15k עד 20k0.37 עד 0.47
500+ משתמשים10k עד 15k0.25 עד 0.35

לדוגמה, אם יש לך 200 משתמשים, תוכל לבקש 20k TPM לכל משתמש, או 4 מיליון TPM בסך הכול (200*20,000 = 4 מיליון).

ה-TPM למשתמש יורד ככל שגודל הצוות גדל מכיוון שפחות משתמשים נוטים להשתמש ב-Claude Code בו-זמנית בארגונים גדולים יותר. מגבלות קצב אלו חלות ברמת הארגון, ולא על כל משתמש בנפרד, מה שאומר שמשתמשים בודדים יכולים לצרוך באופן זמני יותר מהחלק המחושב שלהם כאשר אחרים אינם משתמשים בשירות באופן פעיל.

הערה: אם אתה צופה תרחישים עם שימוש מקבילי גבוה במיוחד (כגון מפגשי הדרכה חיים עם קבוצות גדולות), ייתכן שתזדקק להקצאות TPM גבוהות יותר למשתמש.

#ספקי ענן

ב-Amazon Bedrock, Google Cloud's Agent Platform, ו-Microsoft Foundry, החיוב ב-Claude Code מתבצע לפי אסימון לחשבון הענן שלך, ובקרות ההוצאה נמצאות בלוח הבקרה של החיוב אצל ספק הענן שלך. Claude Code אינו שולח מדדים מהענן שלך בחזרה ל-Anthropic, ולכן לוחות הבקרה של הניתוחים וה-Claude Code Analytics API אינם מכסים שימוש זה.

לייחוס עלויות לפי משתמש, יש לך שלוש אפשרויות:

  • OpenTelemetry: ייצוא מדדים מהמכונה של כל מפתח אל מערך הניטור שלך. זה מעניק לך ספירת אסימונים, עלויות, ופעילות כלים לפי משתמש ללא תלות בספק.
  • שער יישומי Claude (Claude apps gateway): שער Claude apps gateway באירוח עצמי מספק ייחוס שימוש לפי משתמש, מדדי OTLP עם ספירת אסימונים, ומגבלות הוצאה לפי משתמש בספקים אלו.
  • שער LLM (LLM gateway): ניתוב כל תעבורת Claude Code דרך שרת מתווך (proxy) שעוקב אחר הוצאות לפי מפתח. כמה ארגונים גדולים דיווחו על שימוש ב-LiteLLM, כלי קוד פתוח שעוקב אחר הוצאות לפי מפתח. פרויקט זה אינו קשור ל-Anthropic ולא עבר ביקורת אבטחה מטעמה.

#כאשר מפתח שואל על מגבלה

מפתחים בדרך כלל מביאים שאלות על מגבלות למנהל המערכת שלהם, ולכן מועיל לדעת באיזו תקרה הם נתקלו. ארבעת המצבים משמעותם דברים שונים:

  • "You've hit your session limit" או "You've hit your weekly limit": חלון שימוש מבוסס מושב בתוכנית מנוי, המשותף לכל המודלים, כך שהמפתח אינו יכול לשחזר גישה על ידי החלפת מודלים עם /model. ההודעה מציגה מתי החלון מתאפס. לאחר הודעה ספציפית למודל כגון "You've hit your Opus limit" או "You've hit your Sonnet limit", החלפה למודל מחוץ לאותה משפחה באמצעות /model מאפשרת למפתח להמשיך לעבוד. ראה שגיאות מגבלת שימוש. מה שהמפתח יכול לעשות בינתיים:
  • הודעת מגבלת הוצאה מ-Claude apps gateway: המפתח עבר את תקרת ההוצאה שהגדרת בשער באירוח העצמי שלך, והשער חוסם את בקשותיו עד שהתקופה תתאפס או שתעלה את התקרה. ראה מגבלות הוצאה בשער לתקרות, לוחות זמנים לאיפוס, וההודעה שהמפתח רואה.
  • אזהרת הקשר (context) או דחיסה אוטומטית (auto-compact): אינה מגבלת שימוש. השיחה התקרבה ל-חלון הדחיסה האוטומטית (auto-compact window) של ההפעלה, הסף שבו Claude Code מתמצת היסטוריה ישנה יותר כדי לפנות מקום. הפנה את המפתח אל הפחתת השימוש באסימונים.
  • הוצאה גבוהה באופן בלתי צפוי בתוכנית API או ספק ענן: בדרך כלל נובעת מהפעלות ארוכות שמעולם לא נוקו באמצעות /clear או מכך ש-Opus הושאר כמודל ברירת המחדל. ההרגלים בעלי ההשפעה הגבוהה ביותר לתרגול הם ניקוי בין משימות שאינן קשורות והתאמת המודל למשימה, שניהם מכוסים בסעיף הפחתת השימוש באסימונים.

#עלויות אסימונים של צוותי סוכנים (Agent teams)

צוותי סוכנים (Agent teams) מפעילים מופעים מרובים של Claude Code, שלכל אחד מהם חלון הקשר משלו. השימוש באסימונים גדל בהתאם למספר חברי הצוות הפעילים ולמשך הזמן שכל אחד מהם פועל.

כדי לשמור על עלויות צוותי הסוכנים ברמה שניתן לנהל אותה:

  • השתמש ב-Sonnet עבור חברי הצוות. הוא מאזן בין יכולת לעלות עבור משימות תיאום.
  • שמור על צוותים קטנים. כל חבר צוות מפעיל חלון הקשר משלו, כך שהשימוש באסימונים הוא בערך פרופורציונלי לגודל הצוות.
  • שמור על הנחיות יצירה (spawn prompts) ממוקדות. חברי הצוות טוענים את CLAUDE.md, שרתי MCP, ומיומנויות (skills) באופן אוטומטי, אך כל דבר בהנחיית היצירה מתווסף להקשר שלהם מההתחלה.
  • כבה חברי צוות כאשר עבודתם הסתיימה. כל חבר צוות פעיל ממשיך לצרוך אסימונים עד שהוא יוצא או שההפעלה מסתיימת.
  • צוותי סוכנים מושבתים כברירת מחדל. הגדר את CLAUDE_CODE_EXPERIMENTAL_AGENT_TEAMS=1 בקובץ settings.json שלך או בסביבה כדי להפעיל אותם. ראה הפעלת צוותי סוכנים.

#הפחתת השימוש באסימונים

עלויות האסימונים גדלות בהתאם לגודל ההקשר: ככל ש-Claude מעבד יותר הקשר, כך אתה משתמש ביותר אסימונים. Claude Code מבצע אופטימיזציה אוטומטית של העלויות באמצעות מטמון הנחיות (prompt caching), אשר מפחית עלויות עבור תוכן חוזר כמו הנחיות מערכת (system prompts), ודחיסה אוטומטית (auto-compaction), אשר מתמצתת את היסטוריית השיחה כאשר מתקרבים למגבלות ההקשר.

האסטרטגיות הבאות עוזרות לך לשמור על הקשר קטן ולהפחית עלויות לכל הודעה.

#ניהול הקשר בצורה יזומה

השתמש ב-/usage כדי לבדוק את השימוש הנוכחי שלך באסימונים, או הגדר את שורת המצב שלך כדי להציג אותו באופן רציף.

  • ניקוי בין משימות: השתמש ב-/clear כדי להתחיל מחדש בעת מעבר לעבודה שאינה קשורה. הקשר ישן מבזבז אסימונים בכל הודעה עוקבת. השתמש ב-/rename לפני הניקוי כדי שתוכל למצוא בקלות את ההפעלה מאוחר יותר, ולאחר מכן ב-/resume כדי לחזור אליה.
  • הוספת הנחיות דחיסה מותאמות אישית: הפקודה /compact Focus on code samples and API usage מורה ל-Claude מה לשמר במהלך התמצות. בהפעלה חדשה, /compact מדפיס Not enough messages to compact. מכיוון שעדיין אין היסטוריית שיחה לתמצת.

באפשרותך גם להתאים אישית את התנהגות הדחיסה בקובץ CLAUDE.md שלך בשורש הפרויקט:

# Compact instructions

When you are using compact, please focus on test output and code changes

#בחירת המודל הנכון

Sonnet מתמודד היטב עם רוב משימות כתיבת הקוד ועולה פחות מ-Opus. שמור את Opus להחלטות ארכיטקטוניות מורכבות או לחשיבה רב-שלבית. השתמש ב-/model כדי להחליף מודלים באמצע ההפעלה, או הגדר ברירת מחדל ב-/config. עבור משימות פשוטות של תתי-סוכנים, ציין model: haiku בהגדרות תת-הסוכן שלך.

#הפחתת תקורה של שרתי MCP

הגדרות כלי MCP מושהות כברירת מחדל (deferred by default), כך שרק שמות הכלים והוראות השרת נכנסים להקשר עד ש-Claude משתמש בכלי ספציפי. הפעל את /context כדי לראות מה תופס מקום.

  • העדף כלי CLI כאשר הם זמינים: כלים כגון gh, aws, gcloud, ו-sentry-cli עדיין יעילים יותר בהקשר מאשר שרתי MCP מכיוון שהם אינם מוסיפים פירוט לכל כלי. Claude יכול להריץ פקודות CLI ישירות.
  • השבת שרתים שאינם בשימוש: הפעל את /mcp כדי לראות שרתים מוגדרים והשבת את אלה שאינך משתמש בהם באופן פעיל.

#התקנת תוספי בינה לקוד (code intelligence) עבור שפות בעלות טיפוסים

תוספי בינה לקוד (Code intelligence plugins) מעניקים ל-Claude ניווט מדויק בסמלים במקום חיפוש מבוסס טקסט, ומפחיתים קריאות קבצים מיותרות בעת חקירת קוד לא מוכר. קריאה בודדת של "go to definition" מחליפה מה שאחרת היה עשוי להיות grep ולאחריו קריאה של קבצים מועמדים מרובים. שרתי שפה מותקנים מדווחים גם על שגיאות טיפוסים באופן אוטומטי לאחר עריכות, וכך Claude מזהה טעויות בלי להריץ מהדר (compiler).

#העברת עיבוד ל-hooks ולמיומנויות (skills)

Hooks מותאמים אישית יכולים לעבד נתונים מראש לפני ש-Claude רואה אותם. במקום ש-Claude יקרא קובץ יומן רישום (log) בן 10,000 שורות כדי למצוא שגיאות, hook יכול לבצע grep עבור ERROR ולהחזיר רק שורות תואמות, מה שמפחית את ההקשר מעשרות אלפי אסימונים למאות בלבד.

מיומנות (Skill) יכולה להעניק ל-Claude ידע תחומי כדי שלא יצטרך לחקור. לדוגמה, מיומנות של "codebase-overview" יכולה לתאר את ארכיטקטורת הפרויקט שלך, ספריות מפתח, ומוסכמות שמות. כאשר Claude מפעיל את המיומנות, הוא מקבל את ההקשר הזה באופן מיידי במקום לבזבז אסימונים על קריאת קבצים מרובים כדי להבין את המבנה.

לדוגמה, ה-hook מסוג PreToolUse הבא מסנן את פלט הבדיקות כדי להציג כישלונות בלבד:

#settings.json

הוסף זאת אל ה-settings.json שלך כדי להריץ את ה-hook לפני כל פקודת Bash:

{
  "hooks": {
    "PreToolUse": [
      {
        "matcher": "Bash",
        "hooks": [
          {
            "type": "command",
            "command": "~/.claude/hooks/filter-test-output.sh"
          }
        ]
      }
    ]
  }
}

#filter-test-output.sh

ה-hook קורא לסקריפט זה. צור את התיקייה באמצעות mkdir -p ~/.claude/hooks, שמור את הסקריפט שלהלן בתור ~/.claude/hooks/filter-test-output.sh, והפוך אותו לקובץ בר-ביצוע באמצעות chmod +x ~/.claude/hooks/filter-test-output.sh. הוא בודק אם הפקודה היא מריץ בדיקות ומשנה אותה כך שתציג כישלונות בלבד:

#!/bin/bash
input=$(cat)
cmd=$(echo "$input" | jq -r '.tool_input.command')

# If running tests, filter to show only failures
if [[ "$cmd" =~ ^(npm test|pytest|go test) ]]; then
  filtered_cmd="$cmd 2>&1 | grep -A 5 -E '(FAIL|ERROR|error:)' | head -100"
  echo "$input" | jq --arg filtered "$filtered_cmd" \
    '{hookSpecificOutput: {hookEventName: "PreToolUse", permissionDecision: "allow", updatedInput: (.tool_input + {command: $filtered})}}'
else
  echo "{}"
fi

כדי לאמת את ההגדרה, הפעל את /hooks ובדוק שה-hook מופיע תחת PreToolUse. באפשרותך גם להפעיל את Claude Code עם claude --debug-file ./claude-debug.txt ולבקש מ-Claude להריץ את npm test. כאשר ה-hook משכתב את הפקודה, קובץ יומן הרישום הזה מכיל שורת modified tool input keys המפרטת את command ושאר שדות הקלט של Bash.

#העברת הנחיות מ-CLAUDE.md אל מיומנויות (skills)

קובץ ה-CLAUDE.md שלך נטען אל ההקשר עם תחילת ההפעלה. אם הוא מכיל הנחיות מפורטות עבור תהליכי עבודה ספציפיים (כמו בדיקות PR או מיגרציות של מסדי נתונים), אסימונים אלה נוכחים גם כאשר אתה מבצע עבודה שאינה קשורה. מיומנויות (Skills) נטענות לפי דרישה רק כאשר מפעילים אותן, לכן העברת הנחיות ייעודיות אל מיומנויות שומרת על הקשר הבסיס שלך קטן יותר. שאף לשמור על CLAUDE.md מתחת ל-200 שורות על ידי הכללת חומרים חיוניים בלבד.

#התאמת חשיבה מורחבת (extended thinking)

חשיבה מורחבת מופעלת כברירת מחדל מכיוון שהיא משפרת באופן משמעותי את הביצועים במשימות תכנון וחשיבה מורכבות. אסימוני חשיבה מחויבים כאסימוני פלט (output tokens), ותקציב ברירת המחדל יכול להיות עשרות אלפי אסימונים לכל בקשה בהתאם למודל. עבור משימות פשוטות יותר שבהן אין צורך בחשיבה מעמיקה, באפשרותך להפחית עלויות על ידי הורדת רמת המאמץ (effort level) באמצעות /effort או ב-/model, השבתת החשיבה ב-/config, או, במודלים עם תקציב חשיבה קבוע, הורדת התקציב על ידי הגדרת משתנה הסביבה MAX_THINKING_TOKENS, לדוגמה MAX_THINKING_TOKENS=8000. מודלים בעלי חשיבה סתגלנית (adaptive reasoning) מתעלמים מתקציבים שאינם אפס, לכן השתמש ברמות מאמץ במקומם. השבתת החשיבה אינה זמינה במודלים מסוג Fable, שתמיד משתמשים בחשיבה מורחבת.

#האצלת פעולות עתירות פלט לתתי-סוכנים (subagents)

הרצת בדיקות, שליפת תיעוד, או עיבוד קובצי יומן רישום עלולים לצרוך הקשר משמעותי. האצל פעולות אלו אל תתי-סוכנים (subagents) כך שהפלט הנרחב יישאר בהקשר של תת-הסוכן ורק סיכום יחזור לשיחה הראשית שלך.

#ניהול עלויות של צוותי סוכנים

צוותי סוכנים משתמשים בכפי 7 יותר אסימונים בקירוב בהשוואה להפעלות רגילות כאשר חברי הצוות פועלים במצב תוכנית (plan mode), מכיוון שכל חבר צוות מחזיק חלון הקשר משלו ורץ כמופע Claude נפרד. שמור על משימות הצוות קטנות ועצמאיות כדי להגביל את השימוש באסימונים לכל חבר צוות. ראה צוותי סוכנים לפרטים נוספים.

#כתיבת הנחיות (prompts) ספציפיות

בקשות מעורפלות כמו "שפר את בסיס הקוד הזה" מפעילות סריקה רחבה. בקשות ספציפיות כמו "הוסף אימות קלט לפונקציית ההתחברות ב-auth.ts" מאפשרות ל-Claude לעבוד ביעילות עם קריאות קבצים מינימליות.

#עבודה יעילה במשימות מורכבות

עבור עבודה ממושכת או מורכבת יותר, הרגלים אלה מסייעים למנוע בזבוז אסימונים עקב הליכה בכיוון שגוי:

  • השתמש במצב תוכנית (plan mode) למשימות מורכבות: הקש על Shift+Tab כדי לעבור אל מצב תוכנית לפני היישום. Claude חוקר את בסיס הקוד ומציע גישה לאישורך, מה שמונע עבודה חוזרת ויקרה כאשר הכיוון הראשוני שגוי.
  • תקן כיוון מוקדם: אם Claude מתחיל לפעול בכיוון הלא נכון, לחץ על Escape כדי לעצור מיד. השתמש ב-/rewind או הקש פעמיים על Escape כדי לשחזר את השיחה והקוד לנקודת ביקורת (checkpoint) קודמת.
  • ספק יעדי אימות: כלול מקרי בדיקה, הדבק צילומי מסך, או הגדר פלט צפוי בהנחיה שלך. כאשר Claude יכול לאמת את עבודתו בעצמו, הוא מאתר בעיות לפני שתידרש לבקש תיקונים.
  • בדוק באופן הדרגתי: כתוב קובץ אחד, בדוק אותו, ואז המשך. הדבר מאפשר לאתר בעיות מוקדם כאשר זול לתקן אותן.

#שימוש באסימונים ברקע

Claude Code משתמש באסימונים עבור פונקציונליות רקע מסוימת גם כאשר הוא במצב סרק:

  • תמצות שיחה: משימות רקע המתמצתות שיחות קודמות עבור התכונה claude --resume.
  • עיבוד פקודות: פקודות מסוימות כמו /usage עשויות ליצור בקשות לבדיקת סטטוס.

תהליכי רקע אלה צורכים כמות קטנה של אסימונים (בדרך כלל פחות מ-0.04$ להפעלה) גם ללא אינטראקציה פעילה.

#מדוע השימוש מטפס בהפעלה ארוכה

הפעלה שהייתה פתוחה במשך שעות יכולה לנצל חלק גדול בהרבה ממגבלות התוכנית שלך ממה שהפעילות שלך מעידה עליו, בדרך כלל מאחת מהסיבות הבאות:

  • הקשר ארוך: Claude Code שולח את כל השיחה המלאה שלך בכל בקשה, ובכל פעם ש-Claude משתמש בכלים הוא שולח בקשה נוספת הנושאת את מקבץ תוצאות הכלים הללו. עם מטמון הנחיות, Claude Code קורא מחדש את ההיסטוריה הזו לפי תעריף אסימונים במטמון, כך ששאלה של שורה אחת בהפעלה שהייתה פתוחה כל היום עדיין צורכת שימוש עבור כל השיחה כולה. ראה ניהול הקשר בצורה יזומה לדרכים לשמור על הקשר קטן.
  • החטאות מטמון: ההודעה הראשונה שלך לאחר הפסקה ארוכה יותר מ-משך חיי המטמון מחטיאה את המטמון ומעבדת מחדש את ההקשר המלא שלך. משך החיים הוא שעה אחת במנוי, ויורד לחמש דקות ברגע שאתה מושך קרדיטי שימוש. במפתח API או אצל ספק ענן, הוא חמש דקות כברירת מחדל. כדי לשמור על משך חיים של שעה בזמן שימוש בקרדיטי שימוש, בחר את ה-TTL בעצמך. בתוכניות Pro ו-Max, כאשר אתה מחדש הפעלה גדולה לאחר הפסקה ארוכה, Claude Code מציע להמשיך מתוך סיכום כך שבקשות מאוחרות יותר לא יישאו את ההיסטוריה המלאה.
  • משימות מתוזמנות: משימה מתוזמנת מופעלת במרווח הזמן שלה גם כאשר ההפעלה במצב סרק, ושולחת את ההקשר המלא שלך בכל פעם.
  • הודעות בין הפעלות (Cross-session messages): Claude Code מוסר הודעה מהפעלה אחרת שלך כתור חדש כאשר הפעלה זו נמצאת במצב סרק, ושולח את ההקשר המלא שלך בכל פעם. כדי להשהות הודעות נכנסות במקום למסור אותן, הגדר את crossSessionInbound ל-hold.
  • בדיקות סטטוס של יעדים (Goal check-ins): בזמן שעבודת רקע גורמת ל-יעד (goal) פעיל להמתין, Claude Code מבקש מ-Claude לבדוק את אותה עבודה גם כאשר ההפעלה במצב סרק, ופותח תור חדש ששולח את ההקשר המלא שלך. Claude Code מתחיל לכל היותר שלוש בדיקות במצב סרק לכל יעד בין ההנחיות שלך. לפני גרסה v2.1.246, בדיקות במצב סרק לא היו מוגבלות. כדי לכבות בדיקות אלו, הגדר את CLAUDE_CODE_GOAL_CHECKIN_MINUTES ל-0. בדיקות במצב סרק דורשות את Claude Code בגרסה v2.1.236 ומעלה.
  • חברי צוות סוכנים: כל חבר צוות פעיל ממשיך לצרוך אסימונים עד שהוא יוצא.
  • דחיסה (Compaction): הפקודה /compact קוראת את השיחה שהיא מתמצתת, ולכן דחיסת הקשר גדול היא בעצמה בקשה גדולה. כאשר אתה מעוניין בהתחלה חדשה במקום ברציפות, הפקודה /clear אינה עולה דבר.

בתוכניות Pro, Max, Team, או Enterprise, הפירוט ב-/usage מסמן התנהגויות שאחראיות ל-10% או יותר מהשימוש האחרון שלך, כגון הקשר ארוך או החטאות מטמון, כל אחת עם טיפ כיצד להפחית אותה.

#הבנת שינויים בהתנהגות של Claude Code

Claude Code מקבל עדכונים באופן קבוע שעשויים לשנות את אופן הפעולה של תכונות, כולל דיווח עלויות. הפעל את claude --version כדי לבדוק את הגרסה הנוכחית שלך.

לשאלות בנושאי חיוב לגבי החשבון הספציפי שלך, פנה לתמיכה של Anthropic דרך מערכת ההודעות בתוך המוצר:

  • תוכניות מנוי (Pro, Max, Team, Enterprise): התחבר אל claude.ai, לחץ על ראשי התיבות של שמך בפינה השמאלית התחתונה, ובחר ב-Get help.
  • חיוב ב-Console (API): התחבר אל platform.claude.com, לחץ על ראשי התיבות של שמך, ובחר ב-Get help.

ראה כיצד לקבל תמיכה לתהליך המלא, כולל מי יכול להגיע לנציג אנושי בכל תוכנית.