דילוג לתוכן הראשי
חזרה לכל הפרקים
Productionפרק 4
האנטומיה של הסוכן: מה מבדיל צ׳אטבוט שעונה מסוכן שעושה

פרק 4: האנטומיה של הסוכן

פנות בוקר, 04:17. הטלפון רועד על השולחן. אורה, מפתחת, עונה בעיניים כמעט סגורות — ומצפה לבשורות רעות. תמיד זה בוקר רע כשמשהו מצלצל ב-04:17.

בצד השני אין טקסט דחוף של קולגה. יש שורה אחת מסוכן שהיא הפעילה ערב לפני כן: "נמצאה שגיאה בפרודקשן שגורמת לאיבוד עסקאות. פתחתי ענף קוד, כתבתי תיקון, הריץ 19 טסטים — כולם ירוקים. ממתין לאישור לפני מיזוג."

היא הסתכלה על המשפט הזה שוב. הסוכן לא שאל שאלת הבהרה, לא החזיר לה עבודה לתקן, ולא המשיך הלאה. הוא עשה את העבודה — עד הנקודה שבה עבודה הופכת להחלטה. ואז הוא עצר, לחץ בלימה, והמתין לה.

זה הרגע שמפריד בין צ׳אטבוט לבין סוכן. הצ׳אטבוט עונה. הסוכן מסיים — ומבקש חותמת רק כשהדבר הבא הוא בלתי הפיך.

צ׳אטבוט עונה. סוכן מסיים.

רוב האנשים לא חושבים על ההבדל הזה, וזה הבדל של מיליארדי דולרים. אז בואו נפריד אותו למשפט אחד:

  • צ׳אטבוט הוא מערכת שמדייקת מילים: היא מקבלת קלט, מחזירה טקסט, וזה נגמר. היא לא זוכרת שום דבר שלא בתוך השיחה, היא לא נוגעת בכלום, ואם היא טעית — נשארתם עם טקסט שגוי ביד.
  • סוכן הוא מערכת שמדייקת מציאות: יש לו מטרה, יש לו כלים שהוא יכול להזיז איתם את העולם — קבצים, קוד, בסיסי נתונים, APIs, כרטיסיות, אימיילים — יש לו זיכרון שמפריד בין מה שקרה למה שאלת, ויש לו לולאה: הוא מתכנן, פועל, רואה מה קרה, ומתכנן שוב.

הנוסחה של Anthropic, החברה שבנתה את אחד הסוכנים המצליחים בעולם, היא קצרה ומפתיעה: מודל שפה + כלים + לולאה. לא ארכיטקטורה סודית, לא מיליון פרמטרים, לא פטנט. שלושה חלקים שמחוברים נכון.

וכל השאר — התדמית, הקול, ההומור — אלה תכונות אופי של עובד. הנדסה בונה את העובד.

האנטומיה: חמישה חלקים

1. המוח: מודל השפה

המודל הוא הקוגניציה: הוא מבין שפה, כותב קוד, מנתח מסמכים, ומתלבט בין חלופות. הוא גם החלק היקר ביותר במערכת, ולכן בכל לולאה שואלים שאלה אחת חשובה: "האם אני באמת צריך את המוח החזק עכשיו, או שמשימה קטנה תסתפק במודל מהיר וזול?"

סוכן ששורף את המוח היקר על בדיקת שם קובץ בזבז כסף. אדריכלות טובה מכוונת כל שאלה למידל המתאים לה.

2. הידיים: הכלים

כאן קורה הקסם. כלי הוא כל פעולה שהסוכן יכול לבצע בפועל: לקרוא קובץ, להריץ קוד, לשלוח הודעה, להזמין תור, לעדכן שורה בטבלה.

תנו למודל שפה רק טקסט ותקבלו סופר-מתמחה שלא נוגע בכלום. תנו לו ידיים ותקבלו עובד. רוב הפרויקטים שנכשלים ב-AI לא נכשלים בגלל המוח — הם נכשלים בגלל ידיים חסרות או ידיות שבורות.

3. הזיכרון: מה שקרה, לא מה ששאלנו

הזיכרון הוא מה שמבדיל פגישה חד-פעמית מעובד שמכיר אתכם. יש שני סוגים, וצריך להכיר אותם:

  • זיכרון קצר טווח — מה שקרה במהלך המשימה הנוכחית: מה ניסה, מה נכשל, מה כבר נבדק.
  • זיכרון ארוך טווח — מה שנשאר גם אחרי שהמשימה הסתיימה: העדפות שלכם, החלטות קודמות, הסבר על המוצר שלכם, מה טעינו בו בפעם האחרונה.

בלעדיו, כל שיחה מתחילה מאפס. איתו, הסוכן גדל איתכם.

4. הלולאה: מה שבאמת הופך מודל לסוכן

הלולאה היא לב האנטומיה, והיא פשוטה עד כדי חשד:

  1. חשב — מהן האפשרויות שלי עכשיו?
  2. פעל — בחרתי כלי וביצעתי צעד אחד.
  3. צופה — מה קרה בפועל? מה חזר מה-API, מה נכשל, מה השתנה?
  4. חזור ל-1 — עם המידע החדש.

צעד אחד בכל פעם. זה מה שהופך עבודה גדולה לסדרה של צעדים קטנים שאפשר לתקן ביניהם. סוכן שלא רץ לולאה הוא פרומפט ארוך. סוכן שרץ לולאה הוא עובד.

5. המטרה והגבולות

בלי מטרה מנוסחת, הסוכן הוא רכב אוטונומי בלי יעד. עם מטרה — הוא יודע מתי הוא סיים. ובלי גבולות, הוא ירוץ לנצח — או עד שהאשראי ייגמר.

מבפנים: איך נראית לולאה אחת

קחו משימה אמיתית: "תמצא את כל הלקוחות שנותקו החודש, תבדוק למה, ותכין דוח."

  • סיבוב 1: הסוכן בודק אילו כלים עומדים לרשותו — בסיס נתונים, סוכן אנליטי, כלי כתיבה — ומפרק את המשימה לשלוש משימות-משנה.
  • סיבוב 2: הוא מריץ שאילתה. היא נכשלת: שם עמודה לא נכון. לולאה חוזרת, הוא מתקן, מריץ שוב. מתקבלים 214 לקוחות.
  • סיבוב 3: הוא שולף נתוני תשלום לכל אחד, ומחפש דפוס: אמצע תשלום, זמן הצטרפות, שימוש אחרון.
  • סיבוב 4: נמצאה קבוצה שכולה נתקה יומיים אחרי עדכון גרסה. כאן הוא מוסיף דוח: ההשערה, הנתונים שמאחוריה, ומה מומלץ לבדוק.
  • סיבוב 5: הוא בודק מול כללי הארגון — לא לשלוח שום דבר החוצה לפני אישור — ומשאיר את הדוח בתיבת הבדיקה.

ארבע-חמש לולאות, בקשב מלא, בלי העייפות של 04:17, ובלי הפיתוי לדלג על שלב הבדיקה כי "כנראה שזה בסדר". טעות אחת בשאילתה לא נכנסת לדוח: היא נתקלת במציאות, חוזרת ללולאה, ותוקנה.

המנעול: למה הסוכן עצר ב-04:17

המנעול המואר על חזהו של הבנאי בתמונה שבחזית הפוסט הוא לא קישוט — הוא תנאי קבלה. בלי המנעול, הבנאי הזה הוא סיכון, לא עובד. וכך זה עובד גם אצל סוכנים — בלי הרתמה, אין לו זכות לגעת בעולם:

  • הרשאות מדורגות — מה מותר לעשות לבד, ומה דורש חותמת אדם. קריאת נתונים? לבד. שליחת תשלום? לא לבד.
  • תקרות — כסף, זמן ומספר צעדים לכל משימה. סוכן בלי תקרה זה אוטו בלי בלמים.
  • יומן אמת — כל לולאה מתועדת: מה הוחלט, באיזה כלי, עם איזה תוצאה. בלי זה, כשלון ב-04:17 הוא חידה.
  • נקודת עצירה — נקודה שמוגדרת מראש שבה הסוכן עוצר, בדיוק כמו שקרה לאורה. ההבדל בין אסון לבקרת איכות הוא מילה אחת בפרומפט: "עצור ושאל".

זה מה שנקרא harness — הרתמה. היא לא מגבילה את הסוכן. היא זו שמאפשרת לתת לו כוח בכלל.

סוכן אחד לא מספיק: הצוות

ועכשיו הקפיצה שבסוף הפרק השני: מה קורה כשאתם מחברים עשרה סוכנים כאלה?

בדיוק כמו בעסק אמיתי: יש מנהל שמפריד משימות, יש מומחה לכל תחום, ויש מחלקת ביניים שמעבירה מידע. סוכן-מנהל קולט את המשימה, מפצל אותה, שולח לכל מומחה את החלק שלו, ואוסף את התוצאות חזרה. כל מומחה רואה רק מה שנוגע אליו — פחות רעש, יותר דיוק.

ואז נכנסת הידיעה מהפרק הקודם: פרוטוקול MCP. אם הסוכנים הם העובדים, ה-MCP הוא פינת הקפה שמחברת את כולם לאותם מקורות ידע — אותם מסמכים, אותם APIs, אותה אמת אחת. בלי פינת קפה משותפת, לכל סוכן יש גרסה אחרת של המציאות, וצוות כזה עובד מהר יותר אבל טועה ביחד.

למה SaaS צריכה לדאוג

כאן העסק מתחיל לחרוק. חברות תוכנה בנו את העשור האחרון על מנוי: תשלמו חודשית, תקבלו ממשק. אבל ממשק הוא אריזה למודל — והמודל הוא סחורה — ובפרק הראשון ראינו עד כמה מהר מחירה נופל.

כשהיכולת הופכת לזולה וזמינה דרך API, הערך עובר מהמסך לתוצאה. למה לשלם על עשרה מנויים שדורשים מכם ללמוד עשר ממשקים, להעתיק מידע ביניהם ולהיות הקופי-פייסט האנושי של הצוות — כשאפשר לבנות צוות של עשרה סוכנים ייעודיים שעושים את אותה עבודה, באותם מקורות, ונפגשים באותם תקנים?

השינוי במודל: מ"כמה משתמשים מסתכלים במסך" ל"כמה תוצאות אמיתיות נפתרו". מי שימכור גישה לכלים — יתחרה בסוכנים שמבצעים. מי שימכר תוצאה — יבנה סוכנים, או יקנה אותם ממישהו שבנה.

חמשת הכלים שלא נשברו

אחרי שלושה פרקים, הנה מה שאפשר לקחת למחר בבוקר:

  1. הגדירו תוצאה, לא פיצ׳ר. סוכן צריך לדעת מתי הוא סיים. "כתוב לי רעיונות" אין סוף; "הבא שלושה רעיונות שמתאימים לקהל הזה ובחר אחד" יש סוף.
  2. תנו כלים, לא הרשאות. ככלות הכול, העולם שנפתח בפניכם הוא רשימת כלים מצומצמת שאפשר לבדוק אחד-אחד — לא גישה חינמית לכל.
  3. תבנו את הלולאה לפני הפרומפט היפה. לולאה עם צפייה ותיקון מנצחת פרומפט גאוני בלי לולאה, בכל פעם.
  4. תדלגו על המוח היקר כשלא צריך. שאלות פשוטות למודל מהיר, שאלות קשות למודל חזק. זה לא פספוס איכות — זה תבונה תקציבית.
  5. הכל נמדד. כמה לולאות למשימה, כמה טעויות, כמה פעמים נדרש התערבות אדם. מה שלא נמדד, לא משתפר — ואינו נשלח לפרודקשן.

סוף — והפעם יש לכם את התכנית

האנטומיה הזו היא לא תיאוריה. מוח, ידיים, זיכרון, לולאה ומנעול — אלה החמישה שבנו את העובד של 04:17, וזה שהמתין לאורה בסבלנות.

בפרק הבא ניכנס לדבר שמפריד בין דמו יפה למוצר אמיתי: איך מודדים סוכן, איך שוברים אותו לפני שהוא שובר לכם את הפרודקשן, ואיך בונים נקודת ביניים עם לולאה שיודעת לעצור — בזמן.

רוצים לא לפספס? הצטרפו לקהילת הבילדרים בווצאפ ועקבו אחרי סדרת "אני בונה אייג׳נטים".