דלג לתוכן הראשי
צילום: שאטרסטוק
צילום: שאטרסטוק

בין Waze לרכב אוטונומי: מתי באמת בטוח לתת ל-AI את ההגה?

נועם כהן
נועם כהן

המעבר מצ'אט פסיבי לסוכן אוטונומי שמבצע פעולות בשמכם משנה את מאזן הסיכונים ומחייב הגדרת גבולות שליטה ברורים • טעויות עלולות להתגלות מאוחר מדי ללא מנגנוני בקרה והרשאות מוגדרות מראש • הדגשים הקריטיים שיעזרו לכם להחליט מתי להחזיק את ההגה בעצמכם


יש הבדל בין להשתמש באפליקציית ניווט כמו Waze שמציעה לכם מסלול ואתם בוחרים אם להקשיב לה בכל פנייה, לבין לתת לרכב אוטונומי לנסוע לבד בזמן שאתם יושבים במושב האחורי. בשני המקרים אתם יכולים להגיע ליעד, אבל רק במקרה הראשון אתם אלה שאוחזים בהגה ויכולים לתקן טעות תוך כדי נסיעה. ההבדל הזה מתאר בדיוק את מה שקורה כעת בעולם הבינה המלאכותית.

כתיבת הנחיות ל-AI, אילוסטרציה | צילום: שאטרסטוק

OpenAI באזהרה מדאיגה: הסוכנים שלנו מתנהגים באופן לא צפוי

27.09.26נתנאל שמי

בשנה האחרונה המילה סוכן (Agent) נמצאת בכל מקום, וכמעט כל מי שמשתמש בה מתכוון למשהו אחר. הבלבול הזה הוא לא רק עניין של ניסוח, והוא גם לא נחלת מומחים בלבד. השאלה המעשית היא אם הכלי רק מחזיר לכם טקסט לקריאה, או שקיבל גם רשות לבצע פעולה בשמכם. הנה חמש שאלות שעושות סדר:

1. מה בעצם ההבדל בין צ׳אט לסוכן?

צ׳אט עונה, סוכן פועל. בצ׳אט אתם מקבלים טיוטה, קוראים אותה ומחליטים מה לעשות איתה. אתם השלב האחרון. כשנותנים לסוכן רשות לפעול בלי אישור על כל צעד, אפשר לעבוד באוטונומיה מפוקחת (Supervised Autonomy): הוא מבצע רצף פעולות בעצמו ועוצר לבקרה אנושית בנקודות שהוגדרו מראש. הוא יכול לערוך את הקובץ, לשלוח את ההודעה או לשנות את השורה בגיליון עוד לפני שקראתם את התוצאה. מבחוץ שתי המערכות נראות זהות לגמרי: שתיהן חלון עם טקסט. מבחינה מעשית, מה שמבדיל ביניהן הוא לא המודל, אלא ההרשאה: במה מותר לכלי לגעת בלי לשאול אתכם.

צילום: שאטרסטוק

2. למה זה נהיה רלוונטי דווקא עכשיו?

כי הכלים שמחברים בין בינה מלאכותית לפעולות אמיתיות נעשו נגישים לכל אחד. במקום שהמודל רק ייתן תשובות, הוא מסוגל לחשוב, לבצע פעולה, לבדוק את התוצאה ולהמשיך לבד – ממש כמו עובד שמריץ רצף צעדים בלי שצריך לאשר לו כל שלב בנפרד.

אני עובד כך יום-יום בסביבות עבודה מונחות-סוכן הזמינות היום באפליקציות המוכרות, כמו ChatGPT, Claude או Copilot של מיקרוסופט. מה שהשתנה אצלי הוא לא איכות הניסוח, אלא שבסוף התהליך יש תוצר שכמעט ולא נגעתי בו, וכל מה שעשיתי היה להגדיר בהתחלה ולבדוק בסוף.

מודלי AI | צילום: שאטרסטוק

3. מה קורה כשהוא טועה?

כאן נמצא כל ההבדל, וזו השאלה שכדאי לשאול לפני כל השאר.

כשצ׳אט מציע טיוטה, יש לכם הזדמנות לקרוא ולתקן לפני השליחה. אם סוכן קיבל רשות לשלוח בעצמו, אתם עלולים לגלות את הטעות רק אחרי שההודעה הגיעה ללקוח.

לפני שמפעילים סוכן, כדאי לברר מה קורה אם הצעד השלישי מתוך שבעה יוצא שגוי. צריך יכולת לעקוב אחר הפעולות וכללים ברורים לטיפול בשגיאות: מתי מנסים שוב, מתי עוצרים ומי מתערב. האם תדעו שזה קרה, כמה זמן יעבור עד שתדעו והאם אפשר להחזיר את המצב לאחור? ברוב הארגונים שאני נכנס אליהם התשובה לשאלה האמצעית, כמה זמן יעבור עד שתדעו, היא הגרועה ביותר: אף אחד לא בדק ולכן אף אחד לא יודע.

צילום: שאטרסטוק

סוכני ה-AI פיתחו סלנג פנימי ביניהם שהמפקחים לא הצליחו לפענח

25.09.26אפרת ברינר

4. איפה זה כבר עובד ואיפה עוד לא?

זה עובד היטב במשימות שיש בהן צעדים ברורים ובדיקה זולה: לסדר חומר לפי כללים, לעבור על רשימה ארוכה ולסמן חריגים, לבצע את אותו שינוי בדיוק בעשרות פריטים. אלה בדיוק המשימות שאדם מבצע פחות טוב ככל שהוא חוזר עליהן, כי הקשב שלו אוזל.

כשמדובר בסוכן אוטונומי, זה פחות עובד בשני מצבים: כשנדרש שיפוט אנושי שאי אפשר להגדיר בכללים יבשים (כמו לדעת אם לקוח ייפגע מניסוח מסוים) וכשמחיר הטעות גבוה ואין אפשרות להחזיר את הגלגל לאחור. לכן אני עושה הפרדה ברורה בין הכנת תוצר לבין ביצוע פעולה בשטח: ככל שהפעולה רגישה יותר וקשה יותר לתיקון, כך הסוכן מכין יותר ומבצע פחות.

צילום: שאטרסטוק

5. איך יודעים שאנחנו מוכנים?

דף הרשאות הוא התחלה טובה. הדף קצר, אבל הוא מחייב להחליט מי מוסמך לתת כל הרשאה. יש בו שלוש שורות: מה הסוכן רשאי לעשות לבד, מה הוא מכין ואדם מאשר לפני שזה יוצא, ובמה אסור לו לגעת בכלל. את ההחלטות האלה צריך גם לאכוף באמצעות ניהול זהויות וגישה (IAM), עם הרשאות מוגבלות לכל סוכן.

גם אם אתם עובדים לבד, אפשר להתחיל מהקו האדום: אילו פעולות הסוכן לעולם לא יבצע בשמכם?

אחד הדברים שאני הכי אוהב בעבודה עם סוכנים הוא העובדה שעם תכנון טוב לא צריך ללוות כל צעד. המחיר הוא שצריך להחליט מראש איפה הסוכן בכל זאת עוצר ומבקש אישור.

לכן תמיד שווה להתחיל ממשימה חוזרת ומשעממת, שבה אתם יודעים איך נראית התוצאה הנכונה ואפשר להחזיר את המצב לאחור. גם אז צריך להביא בחשבון את זמן ההגדרה והבדיקה ואת עלות השימוש בכלי, אם יש כזו. אם ההשקעה גדולה מהחיסכון, אולי עדיף לעשות את המשימה בעצמכם ולהחליט מראש: האם אתם נוהגים עם Waze ברקע, או יושבים במושב האחורי.

נועם כהן הוא מייסד CritiqeIL, חברת ייעוץ והטמעת AI לארגונים בישראל.