מדריכים מעשיים
מה עושים ביום ראשון: הגדרות, קוד וקבלות החלטה שאפשר לקחת ישר לפרויקט — בלי ניתוחי עומק, רק ביצוע.
מדריכים שלב אחר שלב
איך לבחור מודל למשימה: מחיר, Latency ואיכות
מסגרת החלטה פרקטית לחלוקת משימות בין מודלים גדולים וקטנים, מתי משתלם לשלם על מודל יקר, ואיך מודדים הבדל איכות בפועל ולא לפי תחושה.
בקרת עלויות: איך למנוע מהחשבון של ה-LLM לזנק
מעקב אחר עלות לכל בקשה, קוווטות יומיים, caching של קריאות חוזרות והיררכיית מחירים בין מודלים — עם מספרים, לא עם כוונות טובות.
כתיבת Tools לסוכנים: סכימות, שגיאות ו-Retries
איך כותבים כלים שהסוכן לא ישברו איתם את המערכת: JSON Schema ברור, החזרת שגיאות שהמודל יודע להסיק מהן, ומדיניות ניסיונות חוזרת שלא מסתבכת.
סוכן וואטסאפ בייצור: מ-Webhook עד Session Persistency
מדריך שלב-אחר-שלב להקמת סוכן וואטסאפ שעובד באמת: חיבור Webhook, ניהול סשנים מרובי משתמשים, שמירת מצב בין הודעות וטיפול בהודעות חוזרות.
Eval לפני Production: איך יודעים שהסוכן השתפר
בניית סט בדיקות קטן אבל מייצג, מדידת שיעור הצלחה ורגרסיות, ומתי שווה לעבור ל-Eval מבוסס LLM במקום בדיקה ידנית.
Harness ראשון ב-15 דקות: ולידציה, קוווטות ולוגים
בניית מעטפת הבקרה המינימלית לכל סוכן: סכימת קלט קשיחה, תקרת צעדים ועלות, ולוג לכל קריאת מודל — בלי להוסיף ספריות כבדות.
מאמרי עומק
המאמרים הטכניים המלאים: ארכיטקטורה, זיכרון, פרודקשן ותזמול — מחוץ לזרם הפרקים של הבלוג.
ארכיטקטורת Harness: איך לרתום LLMs למערכות ייצור
למה פרומפט טוב כבר לא מספיק, ואיך מייצרים מעטפת בקרה (Harness) שמבטיחה דטרמיניזם, אבטחה ויציבות לסוכנים אוטונומיים.
ניהול זיכרון ו-Context Window: מעבר ל-RAG פשוט
איך מנהלים זיכרון ארוך-טווח (Long-Term Memory), מתי כדאי להשתמש ב-Graph Memory ומתי ב-Vector Store, ואיך מונעים שכחה קטסטרופלית.
סוכני שיחה בוואטסאפ: מארכיטקטורה ל-Production
מדריך מעשי לבניית סוכנים אינטראקטיביים שרצים בווצאפ: טיפול בריבוי משתמשים, ניהול Session, ואינטגרציה ל-CRM ומסדי נתונים.
Multi-Agent Systems: מתי צוות סוכנים עדיף על סוכן אחן?
השוואה בין ארכיטקטורות היררכיות (Supervisor) לבין רשתות סוכנים שיתופיות. דפוסי עיצוב, מניעת לולאות אינסופיות ובקרת עלויות.