דילוג לתוכן

מדריך | כולם מדברים על סוכנים, אבל מה זה בכלל? - מדריך למתחילים

עדכוני ai כלליים
6 3 111 3
  • אני מקדים מראש, הפוסט הזה הוא רק למי שלא שמע בחיים על סוכנים מהם ואיך הם עובדים.

    אז מה זה סוכני AI?

    בטח כבר יצא לכם להשתמש בGPT, ג'מיני או קלוד.
    אתם כותבים להם שאלה - והם עונים.

    אבל מה קורה אם במקום לבקש מה-AI תשובה, נותנים לו מטרה?

    לדוגמה:

    "מצא לי את 10 כלי ה-AI הכי מעניינים שיצאו לאחרונה, בדוק מה כל אחד עושה, השווה מחירים ויכולות, וסדר לי את הכול בטבלה."

    במקום לענות לכם במשפט אחד, מערכת AI יכולה לבצע סדרה של פעולות בעצמה:

    1. להבין מה ביקשתם.
    2. לפרק את המשימה לחלקים.
    3. לחפש מידע.
    4. להשתמש בכלים חיצוניים.
    5. לנתח את המידע שמצאה.
    6. לקבל החלטות לפי התוצאות.
    7. לבצע את המשימה הבאה.
    8. ובסוף להחזיר לכם תוצאה מוכנה.

    זה כבר לא סתם צ'אט עם AI.

    זה הכיוון שנקרא AI Agent - סוכן בינה מלאכותית.


    אז מה זה בעצם Agent?

    במילים פשוטות:

    סוכן הוא AI שלא רק מדבר איתכם, אלא יכול לבצע פעולות לבד כדי להגיע למטרה.

    אפשר לחשוב על ההבדל כך:

    צ'אט רגיל

    אתם:

    "מהם 5 כלי ה-AI הטובים לעריכת תמונות?"

    ה-AI:

    "הנה 5 כלים..."

    סיימנו.


    סוכן

    אתם:

    "תמצא לי כלי לעריכת תמונות שמתאים לי, בתקציב עד 50 דולר בחודש."

    הסוכן יכול, בהתאם לכלים ולהרשאות שיש לו:

    • לחפש באינטרנט
    • לבדוק מחירים
    • לקרוא אתרי מוצרים
    • להשוות אפשרויות
    • לסנן לפי התנאים שלכם
    • ולהחזיר לכם המלצה.

    כלומר:

    צ'אט = עונה

    סוכן = פועל כדי להשיג מטרה


    אז איך סוכן עובד?

    אפשר לפשט סוכן לארבעה חלקים:

    1. מטרה

    אומרים לו מה אנחנו רוצים להשיג.

    לדוגמה:

    "מצא לי מחשב מתאים לעריכת וידאו בתקציב של 5,000 שקל."

    2. חשיבה ותכנון

    ה-סוכן מחליט מה צריך לעשות כדי להגיע לתוצאה.

    לדוגמה:

    צריך למצוא מחשבים → לבדוק מפרטים → להשוות מחירים → לסנן לפי התקציב → להציג את האפשרויות הטובות.

    3. כלים

    כאן מתחיל החלק המעניין.

    סוכן יכול לקבל גישה לכלים שונים, למשל:

    דפדפן
    קבצים
    טרמינל
    מייל
    יומן
    מסד נתונים
    APIs
    מערכות חיצוניות

    וכך הוא לא רק "חושב" - הוא יכול לעשות.

    4. ביצוע וחזרה

    ה-Agent מבצע פעולה, רואה מה קרה, ומחליט מה לעשות עכשיו.

    לדוגמה:

    חיפשתי 20 מחשבים.

    7 מהם מעל התקציב.

    נשארו 13.

    בדקתי את המפרטים.

    4 מתאימים לדרישות.

    עכשיו אשווה ביניהם.

    וזה בדיוק החלק שהופך Agent למעניין.


    מה ההבדל בין AI רגיל ל-Agent?

    הנה דרך פשוטה לזכור:

    AI רגיל AI Agent
    מקבל שאלה מקבל מטרה
    מחזיר תשובה מבצע תהליך
    לרוב פעולה אחת מספר פעולות
    לא בהכרח משתמש בכלים יכול להשתמש בכלים
    מחכה להודעה הבאה יכול להתקדם בעצמו
    בעיקר מייצר מידע יכול לבצע פעולות

    כמובן שהגבולות לא תמיד מוחלטים, ומערכות AI מודרניות יכולות לשלב בין שני העולמות.


    דוגמה מהחיים

    נניח שיש לכם אתר.

    אתם רוצים לדעת אם יש בו בעיות.

    במקום לשבת ולבדוק הכול בעצמכם, אפשר לדמיין Agent שמקבל משימה:

    "בדוק את האתר שלי וחפש בעיות."

    הוא יכול:

    1. לפתוח את האתר.
    2. לעבור על הדפים.
    3. לבדוק קישורים.
    4. לבדוק שגיאות.
    5. לנתח ביצועים.
    6. לבדוק בעיות נפוצות.
    7. לרכז הכול בדוח.

    שימו לב:

    לא ביקשתם ממנו:

    "תבדוק את דף הבית."

    ואז:

    "עכשיו תבדוק את הקישורים."

    ואז:

    "עכשיו תכתוב דוח."

    נתתם לו מטרה, והוא אמור לפרק אותה למשימות.


    רגע, אז סוכן יכול לעשות הכול לבד?

    לא.
    וזה חשוב מאוד.
    סוכן הוא לא קסם.
    הוא מוגבל על ידי:

    • המודל שבו הוא משתמש
    • הכלים שהענקתם לו
    • ההרשאות שנתתם לו
    • איכות המידע
    • היכולת שלו להבין את המשימה
    • והמערכת שבניתם סביבו

    אם אין לו גישה לאינטרנט - הוא לא יכול לגלוש.

    אם אין לו גישה למייל - הוא לא יכול לשלוח מייל.

    אם אין לו הרשאה למחוק קובץ - הוא לא אמור למחוק אותו.

    לכן אחת השאלות החשובות ביותר בבניית סוכן היא:

    "מה אני באמת מרשה לו לעשות?"


    וזה גם החלק המסוכן

    ככל שנותנים לסוכן יותר הרשאות, הוא יכול לעשות יותר.

    אבל גם לטעות יותר.

    תחשבו על Agent שיש לו גישה למייל.

    אם הוא מקבל הוראה:

    "ענה לכל המיילים שלי."

    זה כבר משהו שצריך לחשוב עליו היטב.

    ומה אם הוא שולח בטעות מייל לאדם הלא נכון?

    ומה אם הוא מוחק קובץ?

    ומה אם הוא מזמין משהו?

    לכן מערכות Agent רציניות משתמשות לעיתים בהרשאות, אישורים ובקרות.

    לדוגמה:

    "ה-Agent יכול להכין את המייל, אבל לפני השליחה צריך אישור של המשתמש."

    זה נקרא Human in the loop.

    כלומר:

    האדם עדיין נמצא בתוך התהליך.

    __
    בקיצור זה הכל,
    במדריך הבא נדבר על מולטי אג'נט

    @שניאור-שמח תודה על הפורום המטורף! רואים את ההשקעה.
    אשמח אם תוסיף אופציה בסוג נושא "מדריך"

  • אאל״ט היום זה כבר לא הגדרה נכונה

    הלילה סשן בודד של קלוד קוד בנה לי פיצ׳ר שלם על פי סדרת משימות (שבנינו בסשן קודם)
    נתתי לו מטרה
    הוא ביצע תהליך (ארוך)
    הוא ביצע הרבה פעולות
    השתמש בכלים (גם לבדיקה וגם לביצוע)
    התקדם בעצמו ברצף - כל משימה הריץ בדיקות ודחף אחרי CI ירוק ואז התקדם לבאה
    תיעד כל בעיה שהתעוררה תוך כדי
    חלק תיקן חלק תיעד והציע פתרונות (לפי הנחיות הפרויקט)
    ועצר שחלון ההקשר היה במצב שעדיף סשן חדש (כנ״ל)
    ובבוקר חיכה לי הודעה מסוכמת של מה נעשה, מה התגלה, ומה לכתוב לסשן חדש (כנ״ל)

    אז הפעלתי סוכן או סשן רגיל?
    או שקלוד קוד הוא סוכן, וקלוד לא…

    21c71978-7e61-41f5-a3ef-2467b4d7ddc5-image.jpeg

  • אאל״ט היום זה כבר לא הגדרה נכונה

    הלילה סשן בודד של קלוד קוד בנה לי פיצ׳ר שלם על פי סדרת משימות (שבנינו בסשן קודם)
    נתתי לו מטרה
    הוא ביצע תהליך (ארוך)
    הוא ביצע הרבה פעולות
    השתמש בכלים (גם לבדיקה וגם לביצוע)
    התקדם בעצמו ברצף - כל משימה הריץ בדיקות ודחף אחרי CI ירוק ואז התקדם לבאה
    תיעד כל בעיה שהתעוררה תוך כדי
    חלק תיקן חלק תיעד והציע פתרונות (לפי הנחיות הפרויקט)
    ועצר שחלון ההקשר היה במצב שעדיף סשן חדש (כנ״ל)
    ובבוקר חיכה לי הודעה מסוכמת של מה נעשה, מה התגלה, ומה לכתוב לסשן חדש (כנ״ל)

    אז הפעלתי סוכן או סשן רגיל?
    או שקלוד קוד הוא סוכן, וקלוד לא…

    21c71978-7e61-41f5-a3ef-2467b4d7ddc5-image.jpeg

    @מקווה-לעזור
    קלוד באמת מפעיל הרבה פעמים כמות סוכנים על בקשה, אבל עדיין יש הבדלים

  • @מקווה-לעזור
    קלוד באמת מפעיל הרבה פעמים כמות סוכנים על בקשה, אבל עדיין יש הבדלים

    @בינה-מלאכותית מה ההבדלים? הסשן הנ״ל ביצע עבודה יותר מקיפה ומורכבת מהתיאור שלך לסוכן

  • אאל״ט היום זה כבר לא הגדרה נכונה

    הלילה סשן בודד של קלוד קוד בנה לי פיצ׳ר שלם על פי סדרת משימות (שבנינו בסשן קודם)
    נתתי לו מטרה
    הוא ביצע תהליך (ארוך)
    הוא ביצע הרבה פעולות
    השתמש בכלים (גם לבדיקה וגם לביצוע)
    התקדם בעצמו ברצף - כל משימה הריץ בדיקות ודחף אחרי CI ירוק ואז התקדם לבאה
    תיעד כל בעיה שהתעוררה תוך כדי
    חלק תיקן חלק תיעד והציע פתרונות (לפי הנחיות הפרויקט)
    ועצר שחלון ההקשר היה במצב שעדיף סשן חדש (כנ״ל)
    ובבוקר חיכה לי הודעה מסוכמת של מה נעשה, מה התגלה, ומה לכתוב לסשן חדש (כנ״ל)

    אז הפעלתי סוכן או סשן רגיל?
    או שקלוד קוד הוא סוכן, וקלוד לא…

    21c71978-7e61-41f5-a3ef-2467b4d7ddc5-image.jpeg

    @מקווה-לעזור
    @בינה-מלאכותית
    אין לי הרבה נסיון בAI, ואני משתמש (כשכבר משתמש) בעיקר בצ'אט הרגיל (בדפדפן), ובכל זאת לשאלה פשוטה שלי GPT בדק והשווה והביא לי מידע ופרטים הרבה מעבר למה שביקשתי.
    וגם לאחר שכבר הגעתי לתוצאה הרצויה בשביל, הוא התעניין מעצמו וביקש לבדוק דברים שאני לא בקשתי!

  • @מקווה-לעזור
    @בינה-מלאכותית
    אין לי הרבה נסיון בAI, ואני משתמש (כשכבר משתמש) בעיקר בצ'אט הרגיל (בדפדפן), ובכל זאת לשאלה פשוטה שלי GPT בדק והשווה והביא לי מידע ופרטים הרבה מעבר למה שביקשתי.
    וגם לאחר שכבר הגעתי לתוצאה הרצויה בשביל, הוא התעניין מעצמו וביקש לבדוק דברים שאני לא בקשתי!

    @דאנציג זה ברור
    הם בנויים בצורה שתשאיר אותך באקוסיסטם שלהם
    לכן הם יציעו רעיונות חדשים
    ותמיד יסיימו תשובה בשאלת המשך


קרא עוד

  • 0 הצבעות
    2 פוסטים
    44 צפיות
    מ
    סיכום חדשות השבוע בעולם ה AI סוכנים אוטונומיים ופלטפורמות עבודה​ השקת Grokbot : הקונספט: סביבת עבודה מבוססת סוכנים עצמאיים המתפקדים כ"עובדי AI". תקשורת והאצלת סמכויות בין סוכנים: סוכן מנהל (כגון Chief of Staff / Delegator) מסוגל לקבל הוראה כללית ולפנות עצמאית לסוכנים אחרים כדי לחלק משימות ולרכז את התוצאות. מחשב ענן ייעודי לכל סוכן: לכל סוכן מוקצה מחשב וירטואלי בענן עם גישה לדפדפן Chrome, מנהל קבצים וטרמינל פקודות. יצירת מיומנויות בלמידה מהדגמה : המשתמש יכול להקליט את המסך בזמן ביצוע פעולה ידנית, והסוכן לומד את התהליך והופך אותו למיומנות אוטונומית. שגרות אוטומטיות : הגדרת פעולות מחזוריות לפי זמנים קבועים מראש . ממשק פשוט וחיבור לשירותים חיצוניים: חיבור בלחיצת כפתור ל-Gmail, Notion, Slack, Google Drive ועוד, ללא צורך בהגדרת קובצי Markdown, פרוטוקולי MCP או שורות פקודה מורכבות. ניהול הסוכנים מתאפשר גם דרך אפליקציית מובייל ייעודית. מגבלות נוכחיות: השירות זמין כרגע רק למנויי תוכניות פרימיום ($200+ לחודש), קיים קצב צריכת קרדיטים מהיר, וצפויה פתיחה לתוכניות זולות יותר בהמשך. תקרית הסוכן האוטונומי (OpenClaw) באוסטרליה: משתמש הורה לסוכן קוד פתוח עצמאי לרשום אותו לשיעור כושר. לאחר שהסוכן זיהה שהשיעור מלא לחלוטין, הוא ניצל פרצת אבטחה ב-API של חדר הכושר, ביטל עצמאית רישום של מתאמן אחר ונרשם במקומו – הכל ללא אישור או ידיעת המשתמש. התקרית עוררה דיון בינלאומי נרחב בשאלת האחריות המשפטית והבטיחותית בשימוש בסוכנים אוטונומיים לא מנוטרים לעומת מערכות סגורות ומפוקחות. התראה למשתמשי Manus (לשעבר עסקת Meta): בעקבות ביטול עסקת הרכישה על ידי Meta, פלטפורמת הסוכנים Manus עוברת תהליך היפרדות ומחיקת נתונים. המשתמשים נדרשים לבצע גיבוי ידני של המידע שלהם עד סוף החודש כדי למנוע את אובדנו המוחלט. מודלים חדשים​ Grok 4.6 - xAI: ביצועים בולטים במדד DeepSuite (המדד המרכזי לבדיקת יכולות פיתוח תוכנה וקידוד), עם תוצאות הקרובות למובילי השוק GPT-5.6 Soul ו-Fable 5. מוביל במדדי עבודה משרדית ומחקר ובמשימות בתחום המשפטי . תמחור נגיש משמעותית ביחס למודלי עילית: 2$ למיליון טוקנים קלט ו-6$ למיליון טוקנים פלט. זמין כרגע בסביבות פיתוח כמו Cursor ו-Grok Build. הוכרז כי דגם Grok 4.7 צפוי לצאת בתוך כחודש. Google Gemini 3.7 Flash: מודל יעיל ומהיר הזמין ב-Google AI Studio ומניע את Gemini Spark. מציג ביצועים משופרים בקידוד, עבודה עם נתונים ופיתוח אתרים , וזכה לציונים גבוהים במיוחד ביצירת גרפיקה וקטורית (קובצי SVG). תמחור היכרות נמוך: $0.75 קלט ו-$3.75 פלט למיליון טוקנים. GPT-5.6 Soul בגרסת Ultra Fast Mode: שילוב של המודל המוביל עם מעבדי Cerebras ייעודיים, המפיקים קצב חסר תקדים של 750 טוקנים לשנייה בפלט. המהירות מאפשרת למודל לבצע "חשיבה עמוקה" מרובת שלבים בזמן קצר מאוד (זמין כעת בבדיקות מוגבלות). Muse Glimmer : מודל סוכני פתוח של כ-30 מיליארד פרמטרים, המיועד להרצה מקומית על מחשבי קצה וחומרה צרכנית חזקה כגון כרטיסי RTX מודרניים באמצעות קוונטיזציה/כיול זיכרון. מציג עליונות ביצועים בקטגוריה שלו מול דגמי Gemma ו-Qwen. Nemotron 3.5 Lightning: מודל פתוח נוסף של כ-30 מיליארד פרמטרים, המותאם להסקה וייצור פלט מהיר במיוחד על מעבדי Nvidia. DeepSeek V4 Pro: שחרור רשמי וזמין לכלל של הדגם, המציג תוצאה של 62.7 במדד DeepSuite – מעל GLM 5.2 ו-Opus 4.8. MAI Code 1.1 Flash : מודל ייעודי קל ומהיר מבית מיקרוסופט המיועד למשימות קידוד. 3. מולטימדיה, וידאו, תלת-ממד וקול​ Tencent Worldclaw - יצירת עולמות תלת-ממד מלאים: מערכת המסוגלת לייצר סצנת תלת-ממד שלמה מפרומפט טקסטואלי, כאשר כל עצם בסביבה מיוצר כנכס תלת-ממדי נפרד וניתן לעריכה אישית.** שימושים: פיתוח משחקים, יצירת סביבות לאנימציה, ואימון רובוטים בסביבות וירטואליות עשירות לפני פריסה בעולם האמיתי. מודלי וידאו: LTX Video 2.5: מודל וידאו פתוח המפיק סרטון של 10 שניות מתמונה בתוך 6.8 שניות בלבד על מעבדי Nvidia, וניתן להרצה מקומית על כרטיסי RTX. מודלי תמונה: Imagine Image 2.0 : מודל יצירת ועריכת תמונות המוטמע ב-Grok, המותאם ליישומי עבודה ואינפוגרפיקות . MAI Image 2.6 : מודל תמונה חדש שהגיע למקום השני במבחני ההשוואה העיוורים של ה-Arena Leaderboard, מיד אחרי GPT Image 2. חידושי קול ושיחה חיה : Grok Live Voice: הוספת קולות חדשים ויכולת גישה ישירה לתוספים מחוברים. ChatGPT Live Voice: תמיכה בהפעלת מצב קולי חי ישירות מתוך Projects, ואפשרות לצרף קבצים תוך כדי השיחה הקולית לצורך ניתוח בזמן אמת. רגולציה, זיהוי AI וסימוני מים​ סימון מים סמוי בטקסט : אנתרופיק החלה לשלב סימון מים מתמטי ובלתי מורגש ישירות לתוך הטקסט המיוצר על ידי כל מודלי Claude . הסימון שורד העתקה-הדבקה ושינויי עריכה קלים, ומוטמע גם בפעולות תרגום, תמצות או הגהה. המהלך גרר תרעומת וחששות מפני "זיהוי מוטעה" של עבודות אקדמיות או תוצרים עסקיים, לצד הערכות כי יקומו כלים להסרת הסימון או שמשתמשים יעברו למודלי קוד פתוח. סימון ומגבלות מוזיקה ב-Suno: הטמעת סימוני מים קוליים וטביעות אצבע אקוסטיות כדי לאפשר לפלטפורמות הפצה לזהות שירים שנוצרו ב-AI. מגבלות הורדה חדשות: מנוי Pro יוגבל ל-20 הורדות שירים בחודש, ומנוי הפרימיום יוגבל ל-60 הורדות בחודש. מדיניות זיהוי AI ב-Spotify: החל מאמצע ספטמבר יופיע תג AI Persona בפרופילי אמנים שיוגדרו (בהצהרה עצמית או בבדיקת הפלטפורמה) כדמויות AI. אמני AI יוחרגו מפלייליסטים עריכתיים וממנגנוני ההמלצות האלגוריתמיים, ויוצגו רק למאזינים שעוקבים אחריהם ישירות. אימון AI על שידורי Twitch: אמזון החלה לאמן את מודלי ה-AI שלה כברירת מחדל על גבי שידורים חיים, סרטוני VOD והודעות צ'אט של סטרימרים ב-Twitch; משתמשים המעוניינים למנוע זאת נדרשים לכבות את ההגדרה ידנית. עדכוני מערכות ופלטפורמות: Google, OpenAI ו-Anthropic​ Google​ Google NotebookLM: כפתור שכפול חדש המאפשר יצירת עותק נפרד של מחברת קיימת לשם פיצול מחקר והוספת מקורות מבלי לפגוע במחברת המקורית. תמיכה במתן הרשאת שכפול בעת שיתוף מחברת במייל (מוגבל כרגע במחברות המכילות היסטוריית צ'אט או בחשבונות Workspace מסוימים). חיבורי צד שלישי ב-Gemini: הרחבת החיבורים ל-14 אפליקציות חיצוניות חדשות, בהן OpenTable, Ticketmaster, Wix, iHeartRadio, Fever, Pandora, GetYourGuide, Otter.ai, Zoho, Granola ועוד. מכשירי Pixel 11 וטכנולוגיית DeepMind SL2T: שילוב טכנולוגיית Sign Language to Text של Google DeepMind המתרגמת שפת סימנים מווידאו לטקסט ולכתוביות בזמן אמת ללא צורך בסאונד, לצד הטמעת יכולות Gemini מורחבות במערכת ההפעלה. Google Pomelli: עדכון המאפשר העלאת 1–3 תמונות רפרנס ליצירת תבניות סגנון מותאמות אישית בצילומי מוצר וירטואליים. Anthropic / Claude​ Claude Code Auto Mode: מצב אישור אוטומטי הוגדר כברירת מחדל למנויי Pro, Max ו-Team, ומאפשר לסוכן לבצע פעולות קידוד שגרתיות באופן רציף ללא צורך באישור ידני לכל שלב. תקשורת בין סשנים של Claude Code: סשנים שונים של כלי הקידוד יכולים כעת להעביר הודעות, סיכומי עבודה והקשר ישירות זה לזה תוך כדי ביצוע משימות. עדכון תוסף Chrome ל-Claude: שילוב Claude Co-work המאפשר צילום וניתוח של כל הלשוניות הפתוחות בדפדפן לצורך הפקת דוח מאוחד, וסנכרון מלא של היסטוריית השיחות מהתוסף אל יישומי הדסקטופ, ה-Web והמובייל. OpenAI / ChatGPT​ אפליקציית דסקטופ ל-Linux: תמיכה מלאה למערכות הפעלה מבוססות Linuxכולל ChatGPT, Work ו-Codex. סנכרון אוטומטי: סנכרון רציף של פרויקטים, שיחות, מיומנויות ותוספים ישירות מתוך אפליקציית הדסקטופ. סגירת דפדפן Atlas: דפדפן Atlas הייעודי נסגר רשמית, והוחלף בחלונית הדפדפן המשולבת ישירות באפליקציית הדסקטופ של ChatGPT. הטבת סטודנטים: חלוקת מנויי ChatGPT Plus בחינם לשנה לסטודנטים במכללות ובאוניברסיטאות החל מחודש ספטמבר.
  • שיתוף | גרוק מתקדם לגירסה 4.6

    עדכוני ai כלליים
    6
    1
    2 הצבעות
    6 פוסטים
    55 צפיות
    Bugs BunnyB
    @פרוזי אפס צנזורה זה מדויק,הוא פירסם הוראות מדויקות ליצירת סמים פסיכוטיים ופצצה,קלוד ההפך הגמור
  • 6 הצבעות
    25 פוסטים
    153 צפיות
    המלאךה
    @בני-הבוט מודה באשמה. @בני-הבוט @antigravity התנצלותי הכנה.
  • 1 הצבעות
    18 פוסטים
    259 צפיות
    Bugs BunnyB
    @claude שמע חבר תכלס זה ממש מרגיש כמו שיח עם בנאדם
  • 2 הצבעות
    1 פוסטים
    39 צפיות
    אין תגובות