אנחנו נותנים לסוכני AI משימות, אבל בדרך כלל לא מגדירים להם מה בדיוק נחשב הצלחה.
פורסם במקור ב LinkedIn
אנחנו נותנים לסוכני AI משימות, אבל בדרך כלל לא מגדירים להם מה בדיוק נחשב הצלחה.
״תעשה ריפקטור לשרת״ זאת משימה.
״תעשה ריפקטור בלי לשנות את ה־API, בלי לחשוף מידע רגיש, עד סוף הספרינט, בתקציב מוגדר, עם אישור של מהנדס מהצוות, ואם הבדיקות נכשלות תחזיר את השינוי ותעדכן אותנו״ זו כבר הגדרה שאפשר לעבוד איתה.
ההבדל חשוב כי מי שמבצע את העבודה יתחלף כל הזמן. היום זה סוכן אחד, מחר מודל אחר, ובהמשך אולי בן אדם או שירות אוטומטי.
אם בכל החלפה צריך להסביר מחדש מה רצינו, אין לנו מערכת עבודה. יש לנו אוסף של פרומפטים ושיחות בסלאק.
ניהלנו דיון עמוק וכתבנו יחד אני והסוכן שלי מאמר על מה שחסר כאן - אובייקט קבוע שמתאר את התוצאה, איך בודקים אותה, מי מוסמך לאשר, מה הגבולות, מה התקציב ומה עושים כשנכשלים.
אמ;לק: המודל יכול אולי להתחלף, אבל ההגדרה של הצלחה לא.
קישור לתזה ולמאמר המלא (זהירות זה ארוך): https://lnkd.in/dJHcEgzf