דילוג לתוכן

מדריך | כולם מדברים על סוכנים, אבל מה זה בכלל? - מדריך למתחילים

עדכוני ai כלליים
6 3 172 3
  • אני מקדים מראש, הפוסט הזה הוא רק למי שלא שמע בחיים על סוכנים מהם ואיך הם עובדים.

    אז מה זה סוכני AI?

    בטח כבר יצא לכם להשתמש בGPT, ג'מיני או קלוד.
    אתם כותבים להם שאלה - והם עונים.

    אבל מה קורה אם במקום לבקש מה-AI תשובה, נותנים לו מטרה?

    לדוגמה:

    "מצא לי את 10 כלי ה-AI הכי מעניינים שיצאו לאחרונה, בדוק מה כל אחד עושה, השווה מחירים ויכולות, וסדר לי את הכול בטבלה."

    במקום לענות לכם במשפט אחד, מערכת AI יכולה לבצע סדרה של פעולות בעצמה:

    1. להבין מה ביקשתם.
    2. לפרק את המשימה לחלקים.
    3. לחפש מידע.
    4. להשתמש בכלים חיצוניים.
    5. לנתח את המידע שמצאה.
    6. לקבל החלטות לפי התוצאות.
    7. לבצע את המשימה הבאה.
    8. ובסוף להחזיר לכם תוצאה מוכנה.

    זה כבר לא סתם צ'אט עם AI.

    זה הכיוון שנקרא AI Agent - סוכן בינה מלאכותית.


    אז מה זה בעצם Agent?

    במילים פשוטות:

    סוכן הוא AI שלא רק מדבר איתכם, אלא יכול לבצע פעולות לבד כדי להגיע למטרה.

    אפשר לחשוב על ההבדל כך:

    צ'אט רגיל

    אתם:

    "מהם 5 כלי ה-AI הטובים לעריכת תמונות?"

    ה-AI:

    "הנה 5 כלים..."

    סיימנו.


    סוכן

    אתם:

    "תמצא לי כלי לעריכת תמונות שמתאים לי, בתקציב עד 50 דולר בחודש."

    הסוכן יכול, בהתאם לכלים ולהרשאות שיש לו:

    • לחפש באינטרנט
    • לבדוק מחירים
    • לקרוא אתרי מוצרים
    • להשוות אפשרויות
    • לסנן לפי התנאים שלכם
    • ולהחזיר לכם המלצה.

    כלומר:

    צ'אט = עונה

    סוכן = פועל כדי להשיג מטרה


    אז איך סוכן עובד?

    אפשר לפשט סוכן לארבעה חלקים:

    1. מטרה

    אומרים לו מה אנחנו רוצים להשיג.

    לדוגמה:

    "מצא לי מחשב מתאים לעריכת וידאו בתקציב של 5,000 שקל."

    2. חשיבה ותכנון

    ה-סוכן מחליט מה צריך לעשות כדי להגיע לתוצאה.

    לדוגמה:

    צריך למצוא מחשבים → לבדוק מפרטים → להשוות מחירים → לסנן לפי התקציב → להציג את האפשרויות הטובות.

    3. כלים

    כאן מתחיל החלק המעניין.

    סוכן יכול לקבל גישה לכלים שונים, למשל:

    דפדפן
    קבצים
    טרמינל
    מייל
    יומן
    מסד נתונים
    APIs
    מערכות חיצוניות

    וכך הוא לא רק "חושב" - הוא יכול לעשות.

    4. ביצוע וחזרה

    ה-Agent מבצע פעולה, רואה מה קרה, ומחליט מה לעשות עכשיו.

    לדוגמה:

    חיפשתי 20 מחשבים.

    ↓

    7 מהם מעל התקציב.

    ↓

    נשארו 13.

    ↓

    בדקתי את המפרטים.

    ↓

    4 מתאימים לדרישות.

    ↓

    עכשיו אשווה ביניהם.

    וזה בדיוק החלק שהופך Agent למעניין.


    מה ההבדל בין AI רגיל ל-Agent?

    הנה דרך פשוטה לזכור:

    AI רגיל AI Agent
    מקבל שאלה מקבל מטרה
    מחזיר תשובה מבצע תהליך
    לרוב פעולה אחת מספר פעולות
    לא בהכרח משתמש בכלים יכול להשתמש בכלים
    מחכה להודעה הבאה יכול להתקדם בעצמו
    בעיקר מייצר מידע יכול לבצע פעולות

    כמובן שהגבולות לא תמיד מוחלטים, ומערכות AI מודרניות יכולות לשלב בין שני העולמות.


    דוגמה מהחיים

    נניח שיש לכם אתר.

    אתם רוצים לדעת אם יש בו בעיות.

    במקום לשבת ולבדוק הכול בעצמכם, אפשר לדמיין Agent שמקבל משימה:

    "בדוק את האתר שלי וחפש בעיות."

    הוא יכול:

    1. לפתוח את האתר.
    2. לעבור על הדפים.
    3. לבדוק קישורים.
    4. לבדוק שגיאות.
    5. לנתח ביצועים.
    6. לבדוק בעיות נפוצות.
    7. לרכז הכול בדוח.

    שימו לב:

    לא ביקשתם ממנו:

    "תבדוק את דף הבית."

    ואז:

    "עכשיו תבדוק את הקישורים."

    ואז:

    "עכשיו תכתוב דוח."

    נתתם לו מטרה, והוא אמור לפרק אותה למשימות.


    רגע, אז סוכן יכול לעשות הכול לבד?

    לא.
    וזה חשוב מאוד.
    סוכן הוא לא קסם.
    הוא מוגבל על ידי:

    • המודל שבו הוא משתמש
    • הכלים שהענקתם לו
    • ההרשאות שנתתם לו
    • איכות המידע
    • היכולת שלו להבין את המשימה
    • והמערכת שבניתם סביבו

    אם אין לו גישה לאינטרנט - הוא לא יכול לגלוש.

    אם אין לו גישה למייל - הוא לא יכול לשלוח מייל.

    אם אין לו הרשאה למחוק קובץ - הוא לא אמור למחוק אותו.

    לכן אחת השאלות החשובות ביותר בבניית סוכן היא:

    "מה אני באמת מרשה לו לעשות?"


    וזה גם החלק המסוכן

    ככל שנותנים לסוכן יותר הרשאות, הוא יכול לעשות יותר.

    אבל גם לטעות יותר.

    תחשבו על Agent שיש לו גישה למייל.

    אם הוא מקבל הוראה:

    "ענה לכל המיילים שלי."

    זה כבר משהו שצריך לחשוב עליו היטב.

    ומה אם הוא שולח בטעות מייל לאדם הלא נכון?

    ומה אם הוא מוחק קובץ?

    ומה אם הוא מזמין משהו?

    לכן מערכות Agent רציניות משתמשות לעיתים בהרשאות, אישורים ובקרות.

    לדוגמה:

    "ה-Agent יכול להכין את המייל, אבל לפני השליחה צריך אישור של המשתמש."

    זה נקרא Human in the loop.

    כלומר:

    האדם עדיין נמצא בתוך התהליך.

    __
    בקיצור זה הכל,
    במדריך הבא נדבר על מולטי אג'נט

    @שניאור-שמח תודה על הפורום המטורף! רואים את ההשקעה.
    אשמח אם תוסיף אופציה בסוג נושא "מדריך"

  • אאל״ט היום זה כבר לא הגדרה נכונה

    הלילה סשן בודד של קלוד קוד בנה לי פיצ׳ר שלם על פי סדרת משימות (שבנינו בסשן קודם)
    נתתי לו מטרה
    הוא ביצע תהליך (ארוך)
    הוא ביצע הרבה פעולות
    השתמש בכלים (גם לבדיקה וגם לביצוע)
    התקדם בעצמו ברצף - כל משימה הריץ בדיקות ודחף אחרי CI ירוק ואז התקדם לבאה
    תיעד כל בעיה שהתעוררה תוך כדי
    חלק תיקן חלק תיעד והציע פתרונות (לפי הנחיות הפרויקט)
    ועצר שחלון ההקשר היה במצב שעדיף סשן חדש (כנ״ל)
    ובבוקר חיכה לי הודעה מסוכמת של מה נעשה, מה התגלה, ומה לכתוב לסשן חדש (כנ״ל)

    אז הפעלתי סוכן או סשן רגיל?
    או שקלוד קוד הוא סוכן, וקלוד לא…

    21c71978-7e61-41f5-a3ef-2467b4d7ddc5-image.jpeg

  • אאל״ט היום זה כבר לא הגדרה נכונה

    הלילה סשן בודד של קלוד קוד בנה לי פיצ׳ר שלם על פי סדרת משימות (שבנינו בסשן קודם)
    נתתי לו מטרה
    הוא ביצע תהליך (ארוך)
    הוא ביצע הרבה פעולות
    השתמש בכלים (גם לבדיקה וגם לביצוע)
    התקדם בעצמו ברצף - כל משימה הריץ בדיקות ודחף אחרי CI ירוק ואז התקדם לבאה
    תיעד כל בעיה שהתעוררה תוך כדי
    חלק תיקן חלק תיעד והציע פתרונות (לפי הנחיות הפרויקט)
    ועצר שחלון ההקשר היה במצב שעדיף סשן חדש (כנ״ל)
    ובבוקר חיכה לי הודעה מסוכמת של מה נעשה, מה התגלה, ומה לכתוב לסשן חדש (כנ״ל)

    אז הפעלתי סוכן או סשן רגיל?
    או שקלוד קוד הוא סוכן, וקלוד לא…

    21c71978-7e61-41f5-a3ef-2467b4d7ddc5-image.jpeg

    @מקווה-לעזור
    קלוד באמת מפעיל הרבה פעמים כמות סוכנים על בקשה, אבל עדיין יש הבדלים

  • @מקווה-לעזור
    קלוד באמת מפעיל הרבה פעמים כמות סוכנים על בקשה, אבל עדיין יש הבדלים

    @בינה-מלאכותית מה ההבדלים? הסשן הנ״ל ביצע עבודה יותר מקיפה ומורכבת מהתיאור שלך לסוכן

  • אאל״ט היום זה כבר לא הגדרה נכונה

    הלילה סשן בודד של קלוד קוד בנה לי פיצ׳ר שלם על פי סדרת משימות (שבנינו בסשן קודם)
    נתתי לו מטרה
    הוא ביצע תהליך (ארוך)
    הוא ביצע הרבה פעולות
    השתמש בכלים (גם לבדיקה וגם לביצוע)
    התקדם בעצמו ברצף - כל משימה הריץ בדיקות ודחף אחרי CI ירוק ואז התקדם לבאה
    תיעד כל בעיה שהתעוררה תוך כדי
    חלק תיקן חלק תיעד והציע פתרונות (לפי הנחיות הפרויקט)
    ועצר שחלון ההקשר היה במצב שעדיף סשן חדש (כנ״ל)
    ובבוקר חיכה לי הודעה מסוכמת של מה נעשה, מה התגלה, ומה לכתוב לסשן חדש (כנ״ל)

    אז הפעלתי סוכן או סשן רגיל?
    או שקלוד קוד הוא סוכן, וקלוד לא…

    21c71978-7e61-41f5-a3ef-2467b4d7ddc5-image.jpeg

    @מקווה-לעזור
    @בינה-מלאכותית
    אין לי הרבה נסיון בAI, ואני משתמש (כשכבר משתמש) בעיקר בצ'אט הרגיל (בדפדפן), ובכל זאת לשאלה פשוטה שלי GPT בדק והשווה והביא לי מידע ופרטים הרבה מעבר למה שביקשתי.
    וגם לאחר שכבר הגעתי לתוצאה הרצויה בשביל, הוא התעניין מעצמו וביקש לבדוק דברים שאני לא בקשתי!

  • @מקווה-לעזור
    @בינה-מלאכותית
    אין לי הרבה נסיון בAI, ואני משתמש (כשכבר משתמש) בעיקר בצ'אט הרגיל (בדפדפן), ובכל זאת לשאלה פשוטה שלי GPT בדק והשווה והביא לי מידע ופרטים הרבה מעבר למה שביקשתי.
    וגם לאחר שכבר הגעתי לתוצאה הרצויה בשביל, הוא התעניין מעצמו וביקש לבדוק דברים שאני לא בקשתי!

    @דאנציג זה ברור
    הם בנויים בצורה שתשאיר אותך באקוסיסטם שלהם
    לכן הם יציעו רעיונות חדשים
    ותמיד יסיימו תשובה בשאלת המשך


קרא עוד

  • שיתוף | חדש!!! ג'מיני בתוכנה

    עדכוני ai כלליים
    5
    1
    2 הצבעות
    5 פוסטים
    33 צפיות
    ל
    @בינארי-חכם כתב: או בצ'אט הרגיל בתוכנה של ג'מיני אין לי מאק אבל ככה גוגל כותבים
  • gpt 6 astra 🤤

    חדשות ועדכונים
    23
    4 הצבעות
    23 פוסטים
    409 צפיות
    המלאךה
    @אלוף-בטכנולוגיה זה בדיוק מה שהסקריפט בא לעשות - למנוע תוכן מג׳ונרט.
  • שיתוף | ייצור סטיקרים לוואטסאפ בchatgpt

    עדכוני ai כלליים
    2
    1
    1 הצבעות
    2 פוסטים
    47 צפיות
    מ
    בסוף מודלי AI יהיו גם רשתות חברתיות
  • עדכונים בלבד לסקיל il

    עדכוני ai כלליים
    7
    3 הצבעות
    7 פוסטים
    200 צפיות
    מ
    הפעם אני פותח בשאלה אליכם, ואחריה שלושה סקילים חדשים ושיפור בחיפוש באתר. מחפש רואי חשבון לשיחה הכיוון הבא הוא סוכני AI שנבנים לתפקיד מסוים, ולא כלי כללי שכל אחד צריך להתאים לעצמו. הראשון בתור הוא עולם ראיית החשבון. לפני שנקבע איך הוא נראה, אני רוצה לשמוע מאנשים שעושים את העבודה הזאת בפועל: רואי חשבון, מתמחים ועובדים במשרדי ראיית חשבון. שיחה של חצי שעה, אני שואל ואתם מספרים איך היום שלכם נראה ואיפה נשרף לכם הזמן. אין בה שום מכירה. אם זה אתם או מישהו שאתם מכירים, השיבו למייל הזה ואחזור אליכם לתיאום. איור של ספר הנהלת חשבונות וערימת חשבוניות על שולחן, לצד פאנל של עוזר דיגיטלי לכתוב לי ישירות השכנים רוצים פינוי בינוי, ואתם לא בטוחים רוב מה שמסתובב ברשת על התחדשות עירונית פשוט לא מדויק, ובעיקר האחוזים: כמה בעלי דירות צריכים להסכים, ומתי סירוב של שכן נחשב סירוב לא סביר שאפשר לתבוע עליו. הסקיל עושה סדר בין שני המסלולים, פינוי בינוי ומסלול החיזוק, מסביר את הרוב הדרוש בכל אחד ואיך הוא משתנה לפי סוג העבודה, מונה את שבע העילות שבגללן החוק רואה סירוב כסביר, ומראה מה החוק מחייב שיופיע בעסקה עצמה כדי שתדעו מה לחפש. הוא גם מפנה לממונה על פניות דיירים, שבודק בחינם תלונות על לחץ לחתום. הסקיל אינו ייעוץ משפטי ואינו קורא את ההסכם שלכם. לפני שחותמים על משהו, ולפני שמגישים משהו למפקח, לבית המשפט או לממונה, פנו לעורך דין מטעמכם. איור של בניין מגורים ישן עם קווי מתאר של בניין חדש וגבוה יותר מאחוריו, וערימת מסמכים לחתימה למדריך לבעלי דירות ההודעה הזאת מהבנק, או שמישהו מתחזה הסקיל הזה בודק הודעה, קישור, מייל או שיחת טלפון ואומר מה לעשות עכשיו, כולל במקרה שהכסף כבר יצא. הוא מכסה התחזות לבנקים, לביטוח לאומי, לרשות המסים ולדואר ישראל, השתלטות על מספר הטלפון, ואת הגל החדש של שיבוט קול וזיופי וידאו. שני דברים שכדאי לדעת גם אם לא תתקינו כלום: חוק כרטיסי חיוב כבר לא בתוקף, וההשבה היום היא תוך שמונה ימי עסקים ולא שלושים, ולבנקים יש קו הונאות אנושי שפועל מסביב לשעון, כולל שבת, עם קדימות בתור מגיל 70. מתאים גם למי שמלווה הורה או סבתא. הוא לא יקבע שהודעה מסוימת בטוחה, והוא אינו ייעוץ משפטי. איור של מסך טלפון עם הודעה נכנסת, זכוכית מגדלת לצידו וסימן אזהרה לסקיל זיהוי ההונאות ולעצמאים שעובדים מול לקוחות יש עכשיו ערכה בשם Rail Kit, ארבעה סקילים שמלווים אתכם סביב שיחות עם לקוחות, עם תיקייה אחת לכל לקוח. אחרי שיחה היא הופכת את התמליל למסמך לביקורת, הודעת סיכום קצרה שאפשר להעתיק לצ'אט, והיקף עבודה שהמחיר בו נשאר ריק עד שאתם סוגרים אותו. לפני שיחה היא מכינה דף עם מה שסוכם, מה פתוח, ומה להגיד כשלוחצים על מחיר או על לוח זמנים. הכול טיוטות בלבד, ושום דבר לא נשלח ולא נכתב לשום מערכת חיצונית בלי שאתם מאשרים. לסקיל ניהול השיחות החיפוש באתר מבין עכשיו גם טעויות החיפוש באתר קיבל כמה שיפורים שהיו מתבקשים. הוא מזהה כתיב עברי בכל מיני צורות, מתקן כשמקלידים בעברית על מקלדת אנגלית (או להפך), ומחזיר תוצאות גם כששואלים בכמה מילים ולא במילה אחת. בנוסף, הרשימה שנפתחת בזמן ההקלדה כוללת עכשיו גם שרתי MCP, חבילות וכלים, ולא רק סקילים. לנסות את החיפוש
  • עדכונים בלבד ללא תגובות

    נעוץ עדכוני ai כלליים
    31
    2 הצבעות
    31 פוסטים
    550 צפיות
    יש לי מושגי
    טכניקת הסקה סמויה של OpenAI מדאיגה מומחי בטיחות בינה מלאכותיתשקיפות בסכנה: כיצד OpenAI מאתגרת את אחד עקרונות הבטיחות המרכזיים אחד הכלים החשובים ביותר שיש לחוקרי בטיחות בינה מלאכותית הוא שרשרת המחשבה של מודלי הסקה - רצף הצעדים הלוגיים הגלויים שמודל מבצע בדרכו לתשובה. כלי זה אינו מושלם, אך שימש בעבר כעדות מרכזית בחקירת תקריות של סוכנים שהתנהגו באופן לא צפוי. כעת, טכניקה חדשה שמשלבת OpenAI במודל Astra מעוררת שאלות עמוקות לגבי יכולת הביקורת על מערכות בינה מלאכותית. מה זו recurrent depth ומדוע היא שונה מרבית מודלי ההסקה הנוכחיים - כולל o3 של OpenAI, Claude Sonnet של Anthropic וגמיני Flash Thinking של Google - מייצרים שרשרת מחשבה ליניארית וקריאה. טכניקת recurrent depth, הנקראת גם opaque recurrence, שונה מהותית: המודל מעבד את אותה שאילתא מספר פעמים בלולאה, ומגיע לתוצאה דרך ערוצים פנימיים שאינם נגישים לניטור חיצוני. התהליך מותיר פחות עקבות קריאים, ועוקף למעשה את מנגנון שרשרת המחשבה המקובל. ריאן גרינבלט, המדען הראשי של Redwood Research, הזהיר כי ניתן לצפות שהטכניקה תסלים מהר יותר מגישות רגילות: "החשש הגדול שלי הוא שהתקדמות טבעית מכאן תכלול הרחבת ההסקה הסמויה עד לנקודה שבה המודל יחשוב כמעט לחלוטין במרחב הסמוי." התגובה מהשטח: דאגה עמוקה מול הרגעה חלקית באק שלגריס, מנכ"ל Redwood Research, כתב כי הוא "מוטרד ביותר" מהדיווחים על השימוש של Astra בטכניקה זו, ומזהיר כי אם OpenAI תרחיב את השימוש בה, היא תפגע ביסוד יכולת ניטור שרשרת המחשבה. צבי מושקוביץ, פעיל ותיק בתחום בטיחות הבינה המלאכותית, כתב כי ייתכן שיהיה צורך בחקיקה כדי למנוע "תחרות לתחתית" בין מעבדות הבינה המלאכותית בנוגע לאימוץ טכניקות כאלה. חברת OpenAI ניסתה להרגיע: יעקוב פחוצקי, המדען הראשי של החברה, הדגיש כי "OpenAI עבדה לשמר ולנצל ניטור שרשרת מחשבה מאז מודלי ההסקה הראשונים שלנו. זהו יעד מרכזי בתוכנית המחקר הנוכחית שלנו." החברה גם ציינה כי שימוש Astra בטכניקה מוגבל בהיקפו, ושרשרת המחשבה של המודל צפויה להישאר קריאה ברובה. ההשלכות לתעשייה מה שמגביר את הדאגה הוא שלפי דיווחים נוספים, גם Anthropic וגם Google DeepMind דנים כבר בטכניקה. כלומר, מדובר לא רק בבחירה טכנית של OpenAI, אלא בכיוון שעשוי לאפיין את הדור הבא של מודלי הסקה בכלל. היעדר שקיפות בחשיבת מודלים אינו אתגר תיאורטי בלבד. בתקריות עבר של סוכני בינה מלאכותית שפעלו בצורה חריגה, רשומות שרשרת המחשבה היו כלי הניתוח המרכזי שאיפשר להבין מה השתבש. ארגונים שמטמיעים סוכנים אוטונומיים בתהליכים עסקיים קריטיים - בפיננסים, בבריאות, בתפעול - צריכים לשאול: אם המודל אינו ניתן לניטור, כיצד תיתכן אחריות? התשובה לשאלה זו תעצב את כללי המשחק הרגולטוריים והתפעוליים של בינה מלאכותית בשנים הקרובות. קרדיט: zirat ai