מאתר את הגורם הכי סביר לתקרית פרודקשן חיה - מלוגים, דיפלויים ותצורה - וממליץ על פעולה.
מיועד לתקריות חיות (לא באג בודד שאפשר לשחזר בנחת) - קפיצת latency, שגיאות שמתרבות, שירות שנופל. מצליב זמן התחלה, דיפלויים אחרונים, שינויי תצורה ולוגים כדי לדרג חשודים.
יודע גם לקרוא סקרינשוט של קונסולת ענן (AWS/GCP וכו') ולתת פקודות מדויקות לתיקון, כולל אזהרה ברורה על כל פעולה הרסנית לפני שמריצים אותה.
מסלול שלישי: כתיבת שאילתת אבחון על לוגים/מטריקות (SQL, LogQL, CloudWatch Insights וכו') והרצה שלה, עם פרשנות של מה שהתוצאה אומרת - לא רק הצגת מספרים יבשים.
אין פקודות ללמוד. אחרי ההתקנה פשוט כותבים לקלוד משפט כמו:
| מה | למה / הערה |
|---|---|
| גישה ללוגים/מטריקות/היסטוריית דיפלויים של הפרויקט | ככל שיש יותר גישה (CLI לענן, מסד נתונים) - האבחון מדויק יותר |
לתשומת לבך: זה כלי אבחון וטריאז' - לא מחליף runbook רשמי או צוות תפעול; פעולות הרסניות על תשתית חיה תמיד מסומנות לאישור מפורש.
פותחים את Claude Code, מדביקים את הבלוק הבא, והוא מתקין הכול לבד:
הי קלוד! התקן לי בבקשה את הסקיל "טריאז' לתקרית חיה" (incident-response). 1. זהה את מערכת ההפעלה שלי ואת התיקייה ~/.claude/skills/ (ב-Windows: C:\Users\<user>\.claude\skills\). צור אותה אם אינה קיימת. 2. הורד את החבילה: https://hiyabh.github.io/claude-skills/dl/incident-response.tar.gz 3. חלץ ממנה את התיקייה skills/incident-response אל ~/.claude/skills/incident-response. אם כבר קיים סקיל בשם הזה - שאל אותי לפני שאתה דורס. 4. בדוק אם מותקנים אצלי: גישה ללוגים/מטריקות/היסטוריית דיפלויים של הפרויקט. אם חסר משהו - תגיד לי בדיוק מה להתקין ותציע להתקין בעצמך. 5. הסבר לי בקצרה איך מפעילים - למשל שאני פשוט אומר: "ה-latency קפץ בשעה האחרונה, תבדוק לוגים ודיפלויים ותגיד מה הגורם הכי סביר".
curl -fsSL https://hiyabh.github.io/claude-skills/install.sh | bash -s -- incident-response
או הורדה ידנית של החבילה וחילוץ אל ~/.claude/skills/.