למה הסוכן שלך טועה - וההגדרה שהופכת אותו למדויק כמעט תמיד
רוב הסוכנים נכשלים כי דוחסים לתוך פרומפט אחד את כל מה שהם צריכים לדעת. אלעד עמרני, שבונה סוכנים לחברות גדולות, פרק בסשן הזה בפעם הראשונה את סוכן-העל האישי שלו - וחשף ארכיטקטורה של שלושה שלבים שמעלה את אחוזי ההצלחה בעשרות אחוזים בלי להעלות עלויות. הרעיון המרכזי פשוט להחריד: כל פעולה מקבלת פרומפט משלה, וסוכן חכם מנתב את הבקשה למקום הנכון. וזה עובד גם אם תחבר לו 100 כלים.

הערת הכתבת: הסשן הזה נגע בכלים ומודלים ספציפיים - n8n, MCP, גרסאות מודלים של OpenAI, סקילס של קלוד. כל אלה עדיין כאן ועובדים מצוין, והתחום זז מהר (אלעד עצמו אמר שמה שבנה לפני שמונה חודשים כבר היה בונה אחרת היום, ושסקילס שינו לו את כללי המשחק). המיומנות הנצחית שנשארת נכונה בכל כלי: לפרק בעיה גדולה לפונקציות קטנות, לתת לכל פעולה הנחיה ייעודית, ולבחור מודל לפי גודל המשימה. אפיין קודם את המטרה - ואז בחר את הכלי לפי התוצאה.
כולנו מכירים את הרגע הזה - בונים סוכן, הוא עובד יופי בהדגמה, ואז בשטח הוא מתחיל להזות, לערבב בקשות, ולשלוח דברים שלא ביקשת. אלעד עמרני, מפתח ווב מעל 17 שנה, לשעבר סמנכל קונים בו, מייסד Brain Commerce והיום שותף ב-Agentic Dev שבונה סוכנים לחברות גדולות, ישב איתנו ופתח את הקופסה השחורה. הוא הראה לחדר את הסוכן האישי שלו - זה שמנהל לו מיילים, אנשי קשר, יומן וקמפיינים דרך וואטסאפ - והסביר בדיוק למה הוא כמעט אף פעם לא טועה.

המסע: 7 תחנות
כל תחנה = מה קרה בסשן + הפרומפט שאורז את זה בשבילכם
מה זה באמת סוכן AI ומתי צריך אותו
אלעד פתח בשאלה שכולנו מגמגמים עליה: מה זה בכלל סוכן, ומתי באמת צריך אחד. ההגדרה שלו כמפתח הייתה נקייה - סוכן זה אישות שחיה זמן קצר ומייצרת סט פעולות באותו זמן חי. אם אתה רק רוצה להעביר קובץ מנקודה A ל-B, הוא אמר, אתה לא צריך סוכן, אוטומציה רגילה מספיקה. אבל ברגע שצריך לקחת החלטה - לאן לשלוח, ל-B בכלל או ל-C - שם נכנסות היכולות של סוכן. הוא תיאר שלוש יכולות ליבה שסוכן חייב, בדיוק כמונו: לחשוב, לזכור ולבצע. וזו נקודת ההכרעה - בכל מקום שבינה צריכה לקחת החלטה ויש לה כלים להשתמש בהם, שם נולד הסוכן.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
ארכיטקטורת שלושת השלבים לסוכן באחוזי הצלחה גבוהים
כאן הגיע הלב של הסשן. אלעד הראה שהסוכן שלו לא עובד כמו שרובנו בונים - מהצד השמאלי ישר לימני, פרומפט אחד גדול שעושה הכל. במקום זה יש שלושה שלבים: סלקטור שמנתב ומנסח פרומפט חדש לפי ההקשר, קלאסיפייר שבוחר איזו קטגוריית פעולה מתאימה, וסוכן ראשי שמבצע רק את מה שקיבל. הוא היה חד לגבי הדרך הנאיבית: 'הם מגיעים מכאן ישר לכאן, לא עושים את זה ולא עושים את זה, ואז הכל פתוח.' התוצאה של הדילוג על האמצע - הזיות ואחוזי כישלון. הבניה בשלבים היא מה שמחזיק את אחוזי ההצלחה גבוהים.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
אבחון: למה הסוכן שלי טועה והזיות
מישהו שאל את השאלה שכולם רצו - למה סוכנים טועים והוזים. אלעד ענה מהשורש: מודל שפה בנוי לתת תשובה תמיד, כמו למלא שאלון אמריקאי. גם אם אין לו את התשובה, הוא ינחש, כי מבחינתו לא לענות זה כישלון. הפתרון שלו הפוך מלנסות לרסן - במקום לתת לו לנחש, מזינים אותו תמיד במידע הרלוונטי בזמן אמת, ואז אין לו סיבה לטעות. הוא הוסיף פרט טכני שהבהיר הכל: יש בסלקטור שלב 'double check' שמוודא שהפעולה באמת קרתה לפני שהוא סוגר את ה-state, ואם לא - מריץ שוב. זה עולה קצת יותר טוקנים, אבל מגדיל דרמטית את הסיכוי להצלחה.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
מיפוי הכלים והפעולות לעוזר האישי שלי
השאלה של החדר הייתה מתי בוחרים MCP ומתי Tool רגיל. אלעד היה נחרץ - אם יש MCP, תמיד עדיפות ל-MCP. הסיבה: בתקשורת של MCP עם הסוכן יש הבהרה ברורה איזה כלים יש לו, והוא יודע לבד מה להנגיש ובאיזו צורה, בצורה אוטומטית. הוא הסביר שפעם היינו צריכים לעשות את זה ידנית - show me your tools, לקבל את הרשימה, לקרוא את התיאור של כל אחד ורק אז לבחור. היום כל זה קורה מעצמו. הוא תיאר MCP בתור 'API על סטרואידים' - במקום המון endpoints שכל אחד צריך הגדרה נפרדת, יש אחד שיודע לדבר עם הסוכן ולתת לו לבחור. וכן, אפשר לבנות MCP משלך.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
בניית ה'מוח' — פרומפט ייעודי לכל פעולה
פה נחשף מה שנתנאל כינה 'החידוש העיקרי' - המוח. אלעד הראה שכל קטגוריית פעולה מחזיקה שלושה דברים בלבד: תוכן, שם ו-think. ה'תוכן' הוא בעצם פרומפט ייעודי לחלוטין - למשל, לשליחת מייל בג'ימייל יש הנחיה מדויקת: מה התפקיד, איזה תהליך לעבור, איפה לבדוק את איש הקשר, מה לעשות אם אין מייל, ואפילו תבנית HTML למייל. ה'think' הוא רשימת הבדיקות שהסוכן הבא יריץ כדי לוודא שהפעולה בוצעה נכון. הרעיון שהרשים את החדר: אתה כותב את זה פעם אחת לכל כלי, וזהו. הוא נתן דוגמה אחת והשאיר את כולם לדמיין את השאר - reply, label, get, כל אחד עם הפרומפט שלו.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
פרומפט הסוכן הראשי עם Go/No-Go ועדכוני זמן אמת
הסוכן הראשי, אלעד הדגיש, הוא כזה רק לכאורה - עשינו לו הרבה עבודת הכנה כדי שיצטרך לעשות מעט. הוא מקבל את הפרומפט המדויק שהסלקטור ניסח, את התאריך של היום, ואת ההוראות הקבועות. וכאן החלק שכולם רשמו לעצמם - ה-Go/No-Go. אלעד הראה חי איך שלח בקשה לשלוח מייל לאשתו, והסוכן הכין טיוטה, עדכן אותו בכל שלב בוואטסאפ ('התחלתי לאתר את המייל', 'מכין טיוטה'), וביקש אישור מפורש לפני השליחה. 'אין סיכוי בעולם שאתה שולח מייל בלי אישור שלי', הוא אמר. העדכונים בזמן אמת הם לא קישוט - הם קריטיים לעבודה עם סוכן שמבצע פעולות ארוכות, כי אחרת אתה יושב בחוסר ודאות.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
הגנות, זיכרון ובחירת מודלים לכל שלב
הרבע האחרון היה מוקדש להגנות, זיכרון ומודלים - ופה אלעד היה פרקטי בטירוף. בכניסה של הוואטסאפ הוא בנה בדיקות 'שנכתבו בדם': אם המספר לא שלו - חוסם. אם זו הודעת קבוצה - מתעלם. הוא סיפר שכבר נכווה כשחימם את המספר בקבוצות וכל הודעה נכנסה פנימה. הזיכרון משותף בין כל הסוכנים דרך קו אדום לזיכרון מרכזי, אבל מוגבל לעשר הודעות אחרונות בלבד - כי כמה הודעות באמת שייכות לאותו הקשר. יש גם פקודת 'נקה' שמאפסת את השיחה כשעוברים נושא. ועל בחירת מודלים - הוא היה נחרץ: הסלקטור רץ על מודל זול כי הפעולה קלה, והקלאסיפייר צריך חלון קונטקסט גדול כי הוא מחזיק הרבה מידע. תבחר מודל לפי גודל המשימה, לא ההפך.
ההמשך המלא של הפרומפט שמור לחברי אוטוטיוזדיי פלוס יחד עם ההקלטה והתמלול המלאים של הסשן
שורות ההמשך כוללות את כל ההנחיות המדויקות והדוגמאות שהוצגו בשידור החי מול הקהילה
🎯 מה עושים עם זה עכשיו?
קראת איך זה נעשה. עכשיו קחו את הכלים ותעשו את זה בעצמכם - כל הפרומפטים של הסשן, מוכנים להריץ על העסק שלכם. פלוס ההקלטה המלאה והתמלול.
הצטרפו לאוטוטיוזדיי+· 49 ש״ח בחודשעוד לא בשלים? בואו ללייב הבא בחינם ←רוצים לעבוד על התמלול הנקי?
העתיקו אותו ותעבדו איתו איך שנוח לכם.
🔒 התמלול המלא שמור לחברי אוטוטיוזדיי+. עם המנוי אתם מעתיקים אותו בקליק ועובדים איתו איך שנוח לכם.
לפתוח את התמלול · 49 ש״ח בחודששאלות ששאלתם (וה-AI ישאל גם)
מתי בכלל צריך סוכן ומתי מספיקה אוטומציה רגילה?
אם אתה רק מעביר מידע מנקודה אחת לשנייה - זו אוטומציה רגילה, לא צריך סוכן. ברגע שצריך לקחת החלטה על סמך בינה, למשל להבין לאן לשלוח בקשה מתוך כמה אפשרויות, שם נכנסות יכולות הסוכן: לחשוב, לזכור ולבצע.
למה לא לדחוס את כל הפעולות לפרומפט אחד בסוכן ראשי?
כי אחוזי ההצלחה צונחים - אלעד דיבר על ירידה בעשרות אחוזים. יותר מדי בקשות והנחיות במקום אחד גורמות לסוכן להתבלבל, לערבב פעולות ולהזות. הפתרון: פרומפט ייעודי לכל פעולה, וסלקטור שמנתב רק את מה שרלוונטי.
MCP או Tool - מה עדיף?
אם יש MCP, כמעט תמיד עדיפות ל-MCP. הוא מבהיר לסוכן אוטומטית איזה כלים יש לו ובאיזו צורה להשתמש בהם, בלי שתצטרך להגדיר כל endpoint בנפרד. אלעד תיאר את זה כ-API על סטרואידים.
האם ארכיטקטורה מבוססת וואטסאפ מגבילה אותי לפלטפורמה אחת?
לא. אלעד הדגיש שהמנוע מבודד מהפלטפורמה - וואטסאפ הוא רק ערוץ הכניסה, ואפשר לחבר במקבילה מייל, סלאק או כל ערוץ אחר. המהות היא שאתה לא תלוי בפלטפורמה אחת.
כמה זה עולה להריץ סוכן כזה עם כל שכבות הבדיקה?
פחות ממה שחושבים. השלבים הקלים רצים על מודלים זולים, והזיכרון מוגבל לעשר הודעות כדי לא לנפח טוקנים. אלעד העריך שגם משתמש כבד לא יעבור כמה דולרים בחודש - הערך גבוה בהרבה מהעלות.
💬 הדיון על הסשן
שאלות, תובנות, מה יישמנו - השרשור של הקהילה.
עוד אין תגובות - תהיו הראשונים לפתוח את הדיון 👇
