בוובינר "From ChatGPT to Agentic AI: First Steps with Claude Cowork for QA Engineers", הציג איגור גולדשמידט כיצד עולם הבינה המלאכותית מתקדם משימוש במודלי שפה שמספקים תשובות בלבד, לעבודה עם סוכנים חכמים (Agentic AI) שמסוגלים לבצע משימות שלמות ולהחזיר תוצרים מוכנים.
איגור הסביר את ההבדל בין Chat LLM, שמתפקד כ"יועץ" המספק מידע והמלצות, לבין Agentic AI, שפועל כ"עובד" שמקבל מטרה ומבצע את כל השלבים הנדרשים להשגתה. בעוד שבעבודה עם צ'אט המשתמש עדיין נדרש להעתיק, להדביק, לעבד ולארגן את התוצאות, סוכן AI יכול לבצע את העבודה בעצמו ולהחזיר קובץ, דוח או תוצאה מוגמרת.
בהמשך הוצגו המרכיבים המרכזיים של Claude Cowork: Skills (יכולות ייעודיות לביצוע משימות), Agents (מומחים ממוקדים), Projects (סביבות עבודה בעלות זיכרון והקשר משלהן) ו-MCP המאפשר חיבור לכלים חיצוניים כמו Jira, Slack ו-Google Drive. השילוב בין הרכיבים הללו מאפשר ליצור סביבת עבודה חכמה שבה הסוכן בוחר בעצמו את הכלים הדרושים ומבצע את המשימה מקצה לקצה.
אחת הנקודות החשובות בהרצאה הייתה חשיבות ניהול ההקשר (Context). איגור הדגיש שכאשר מבקשים מסוכן לבצע יותר מדי משימות במקביל, הוא עלול לאבד מיקוד ולהתחיל לייצר טעויות או הזיות (Hallucinations). לכן מומלץ לבנות סוכנים ממוקדים, בעלי אחריות ברורה ומוגדרת היטב, ולחלק משימות מורכבות לתת-סוכנים המתמחים בתחומים שונים.
במהלך ההדגמה החיה נבנה Static Testing Agent שתפקידו לבצע סקירה סטטית של מסמכי דרישות (PRD). הסוכן זיהה עמימויות, סתירות, דרישות חסרות ודרישות שאינן ניתנות לבדיקה, תוך הפניה למקור המדויק במסמך. ההדגמה המחישה כיצד ניתן להשתמש בסוכנים כדי לשפר את איכות הדרישות עוד לפני כתיבת קוד או תכנון מקרי בדיקה.
לקראת סיום, הוצגו מספר המלצות לבודקי תוכנה העובדים עם AI: לא לסמוך באופן עיוור על תוצאות המערכת, לבקש תמיד סימוכין לממצאים, להיות מודעים להטיות קוגניטיביות אנושיות, ולהתייחס לפלט של הבינה המלאכותית כמו לעבודה של עובד חדש בצוות – כזה שיכול לחסוך זמן רב, אך עדיין דורש בקרה מקצועית.
המסר המרכזי של הוובינר היה שבודקי תוכנה צריכים להתחיל לחשוב פחות במונחים של "כתיבת פרומפטים" ויותר במונחים של "הגדרת תוצאה רצויה". ככל שהמטרה תהיה ברורה וממוקדת יותר, כך סוכני הבינה המלאכותית יוכלו להפוך לכלי עבודה משמעותי שמסייע בשיפור האיכות, היעילות והפרודוקטיביות של צוותי ה-QA.
קישור למצגת של איגור