דילוג לתוכן העיקרי

אנשים מאשרים 97% מהבקשות. מה זה אומר על הבקרות בעסק שלכם

סוכנים2 דקות קריאה

מ-14 באוגוסט Claude Code יעבוד לבד כברירת מחדל. הנימוק של Anthropic הוא נתון אחד, ושווה לקרוא אותו גם אם לא כתבתם שורת קוד בחיים.

ב-14 באוגוסט Anthropic מעבירה את Claude Code למצב אוטומטי כברירת מחדל, בחשבונות Pro, Max ו-Team. עד היום הכלי עצר וביקש אישור כמעט לכל פעולה. מעכשיו הוא ימשיך לבד, ויעצור רק לפני פעולה שמוגדרת כבלתי הפיכה, הרסנית, או כזו שמכוונת אל מחוץ לסביבה שלכם.

אני מלמד לעבוד עם Claude Code בסדנאות, אז השינוי נוגע לי ישירות. אבל הסיבה שבחרתי לכתוב עליו היא לא הכלי. היא נתון אחד שמופיע בהודעה.

בדיקה ידנית שהפכה לטקס

Anthropic פרסמה בדיקה על 1,053 משתמשים משלמים. במצב האוטומטי נתפסו 89% מהפעולות המזיקות. בבדיקה אנושית — 13.6%. ההסבר שהם נותנים לפער הוא פשוט, ולא נעים.

בדיקה ידנית יכולה להפוך להרגל: משתמשים מאשרים 97% מבקשות ההרשאה.

עצרו רגע על המספר הזה, כי הוא כבר לא על תכנות. כל "אדם בלולאה" שהגדרתם בעסק חי בדיוק באותו מקום: מנהל שמאשר הנחות, בקר שמאשר חשבוניות, מישהו שאמור לאשר כל מייל שהבוט שולח. כשמבקשים מבן אדם לאשר הכל, הוא מפסיק לקרוא. זה לא רשלנות, זו התנהגות אנושית צפויה.

מה עושים עם זה במערכת שלכם

המסקנה היא לא "תורידו את הבלמים". היא שבלם שלוחצים עליו 97 פעמים מתוך 100 הוא לא בלם אלא טקס. עדיף מעט נקודות עצירה שבאמת עוצרים בהן וקוראים, ובכל השאר יומן פעולות מלא שאפשר לחזור אליו — מאשר אישור על כל צעד שאף אחד לא מסתכל עליו.

לצד השינוי Anthropic הוסיפה שני דברים: סינון של הזרקות פרומפט, וכללי חסימה קשיחים שאפשר להגדיר מראש. זה בערך המבנה הנכון גם לסוכן שרץ אצלכם — הרשאות מוגדרות מראש, קו אדום שלא נחצה בשום מקרה, ותיעוד של כל מה שקרה.

עוד מוקדם לדעת איך זה יתנהג בשטח. השינוי נכנס לתוקף ב-14 באוגוסט, והבדיקה שפורסמה היא של Anthropic על המוצר של עצמה. אבל השאלה שהיא מעלה בעסק שלכם כבר לא תיאורטית: כמה מהאישורים שאתם מבקשים מהצוות באמת נקראים?

המקורות

המאמר נכתב מהדיווחים האלה, ולא מעתיק אותם. כדאי לקרוא את המקור לפרטים המלאים.

רוצים שזה יעבוד אצלכם ולא רק בכותרות?

כל מה שנכתב כאן הוא בסוף כלי. אם משהו מזה נשמע רלוונטי לתהליך שלכם — דברו איתי ונראה מה אפשר לבנות.