<?xml version="1.0" encoding="UTF-8"?><rss xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:atom="http://www.w3.org/2005/Atom" version="2.0"><channel><title><![CDATA[מדריך | איך עובד ה-AI מאחורי הקלעים, כולל עיקרי הארכיטקטורות והטכנולוגיות השונות.]]></title><description><![CDATA[<p>
                <button class="btn btn-primary extended-markdown-spoiler" data-bs-toggle="collapse" data-bs-target="#spoiler1761" aria-expanded="false" aria-controls="spoiler1761">
                    Spoiler <i class="fa fa-eye"></i>
                </button>
                </p><div class="collapse" id="spoiler1761">
                    <div class="card card-body spoiler"><p dir="auto">תמיד רצית להבין באמת איך עובד הפלא הזה? עכשיו אתה יכול! תמצא זמן לקרוא בעיון את הסקירה.<br />
השתדלתי מאד לפשט את הדברים כמה שיותר, ולכתוב אותם בצורה שכל אחד יוכל להבין אם הוא רק יאחז ראש</p></div>
                </div><p></p>
<h1><a class="anchor-offset" name="בינה-מלאכותית"></a>בינה מלאכותית</h1>
<p dir="rtl">נתחיל קודם עם בנין המושגים, התחום הכולל נקרא <strong>Artificial Intelligence</strong> (AI) - בינה מלאכותית, כלומר מערכת דיגיטלית שמחקה התנהגות חכמה. השם הוטבע בשנת 1956 בכנס שנערך במכללת Dartmouth (דארטמות') שבארצות-הברית. כבר בשנת 1950 פרסם המדען אלן טיורינג את המדד מה יקרא שמכונה חושבת - אם אדם לא יוכל להבחין בין שתי תגובות שהוא מקבל מה כתב אדם ומה כתב המחשב.</p>
<h1><a class="anchor-offset" name="למידת-מכונה"></a>למידת מכונה</h1>
<p dir="rtl">בשנות ה- 80-90 הבינו שלא אפשרי לתכנת התנהגות חכמה על-ידי כתיבת כללים, זה מורכב מידי, במקום זה, צריך ללמד את המחשב ללמוד לבד מהרבה דוגמאות חכמות שנותנים לו. תחום זה נקרא <strong>Machine Learning</strong> (ML) - למידת מכונה.</p>
<h1><a class="anchor-offset" name="למידה-עמוקה"></a>למידה עמוקה</h1>
<p dir="rtl">בסביבות שנת 2006 הייתה קפיצה נוספת בתחום. עד אז למידת המכונה עבדה בפן הטכני בצורה פשוטה - המחשב למד ממוצע של מה אמור להיות אחרי כך וכך וכדומה, אך אז הבינו, שבשביל שהמחשב יוכל ללמוד ולהכניס לעצמו את כל הדוגמאות שהוא לומד, צריכים להשתמש בחשבונות מורכבים יותר - הרעיון ברור, כמה שדוגמאות האימון יותר ישפיעו ויכנסו למחשב, הוא יהיה יותר חכם, בשביל זה המציאו <strong>Neural Networks</strong> (רשתות נוירונים), שזה בעצם מהלך חדש של האימון, במקום רק לכוונן מספרים של כל מילה שהמחשב לומד, כותבים יצוג מספרי למילה הכולל כמה מספרים (נקרא '<strong>וקטור</strong>'), (מה זה מילה? משתמשים בשיטת <strong>BPE</strong> - לא לוקחים את כל המילים שקיימות בעולם, אלא לוקחים מאגר טקסט ענק (בשפות הרצויות) ובודקים מה הרצפים הכי נפוצים שם, בתחילה זה כמובן יהיה התוים היחידים, בהמשך גם זוגות תוים, ואף מילים שלימות, עד לכמות שרוצים את גודל המילון, כל רצף תוים כזה שנוצר נקרא '<strong>טוקן</strong>'), וכותבים טבלאות של מספרים, שקובעות על כל אחד מהמספרים בוקטור הישן כמה הוא ייוצג בכל אחד מהמספרים בוקטור החדש (על-ידי הכפלה של כל מספר בוקטור הישן במשקל הספציפי שלו למספר החדש הזה וחיבור התוצאות של כל המספרים עבור כל מספר בוקטור החדש), כמו"כ מוסיפים גם מספר (הטיה) לתוצאה, וזה הופך למספר בוקטור החדש.</p>
<h1><a class="anchor-offset" name="אימון"></a>אימון</h1>
<p dir="rtl">האימון משפיע על כל אחד מהמספרים האלו, כולל הוקטור עצמו, רשתות הנוירונים ומספר ההטיה, המחשב רואה מה באמת היה הטוקן הבא, ומקרב את התוצאה של הטוקן הזה - על-ידי חשבונות מתמטיים מסובכים, המחשב בודק כל מספר בכמה צריך לשנות אותו ולאיזה כיוון, בשביל שהתוצאה תהיה קרובה יותר לאמת.</p>
<h1><a class="anchor-offset" name="שכבות"></a>שכבות</h1>
<p dir="rtl">למעשה המושג של רשתות נוירונים כבר היה קיים קודם, אלא שאז המציאו את ה'רשתות נוירונים העמוקות', שמורכבות מכמה שכבות שונות של רשתות נוירונים שמשנים שוב ושוב את הוקטור. בין כל רשת ורשת חייב להיות חישוב לא-לינארי (כלומר לא חישוב על-פי המספר כמו כפל וכדומה) כי בלי זה מפסידים את המעלה של כמה שכבות, כי זה בעצם מכפלה אחת שנעשית בכמה שלבים, ואין כאן באמת הרבה מספרים שהאימון משפיע עליהם.<br />
בעבר היו משתמשים בחישוב <strong>Sigmoid</strong> שדוחס את כל המספרים לטווח שבין 0 ל-1, אחר-כך השתמשו ב-<strong>Tanh</strong>, שדוחס בין -1 ל1, ב-2010 המציאו את <strong>ReLU</strong> שרק מוחק כל מספר שמתחת ל-0. ב-2016 המציאו את <strong>GELU</strong> שלא מוחק לגמרי ל0, אלא משאיר קצת לפי הסיכוי שיש שאם נוסיף מספר אקראי למספר השלילי הזה, הוא יעבור את ה0, כך מספר שלילי גבוה כמעט נמחק, ומספר שלילי נמוך, נשאר חלקית. שנה אחר-כך הומצא <strong>SiLU</strong> שלוקח את המספר השלילי ומכפיל אותו בדחיסה של עצמו (הSigmoid שדיברנו עליו קודם שדוחס הכל בין 0 ל1). בשנת 2020 המציאו את הפונקציה שבשימוש היום, <strong>SwiGLU</strong> או <strong>GeGLU</strong>, במקום רשת אחת שיוצרת את המספר, יוצרים שתי רשתות נפרדות, באחת מעבירים ומשתמשים בGELU או בSiLU שדיברנו קודם, ובשניה לא, ואז מכפילים את שתי המספרים שיצאו זה בזה.</p>
<h1><a class="anchor-offset" name="רשת-ffn"></a>רשת FFN</h1>
<p dir="rtl">לפני החישוב הבלתי לינארי, מגדילים את הוקטור כפול 4, על-ידי רשת נוירונים גדולה כפול 4 שנותנת משקולת מתוך כל המספרים בוקטור הישן לכפול 4 מספרים. לאחר החישוב, מחזירים את הוקטור לגודל המקורי - שוב פעם מעבירים בטבלה גדולה אך הפוכה - שנותנת לכל אחד מהמספרים משקל בכל אחד מהמספרים בוקטור החדש הקטן יותר. למעשה כיום שמשתמשים בSwiGLU או GeGLU, שיוצרים 3 רשתות במקום 2, בשביל שיצא פי 4, משתמשים ביחס של 8/3.</p>
<h1><a class="anchor-offset" name="transformer"></a>Transformer</h1>
<p dir="rtl">בשנת 2017 חוקרים מגוגל פרסמו את הארכיטוקטורה <strong>Transformer</strong> (טרנספורמר), שהיא שולטת עד היום. ההמצאה בארכיטקטורה הזו היא שהמחשב יכול לזהות כמה כל מילה בתוך משפט אמורה להשפיע על המילה הבאה שלאחר המשפט, בשונה מעד אז שכל המילים במשפט השפיעו באופן שווה (או שכל מילה השפיעה רק על המילה שאחריה) מה שלא נתן למודל להגיע לחכמה אמיתית.<br />
בשביל להגיע למדד כמה כל מילה אמורה להשפיע, צריכים שיהיו בנוסף לרשת נוירונים הרגילה שמכפילה ומשנה את המספר של המילה עצמה (נקראית רשת <strong>V</strong>alue), עוד שתי רשתות נוירונים שונות, כי כל מילה צריכה בנוסף ליצוג החדש שלה עצמה, גם יצוג כמה היא משפיעה על המילים האחרות במשפט וכמה מילים אחרות משפיעות עליה (כלומר, המספר שיוצא לאחר ההכפלה ברשת השניה (<strong>Q</strong>uery), כמה הוא דומה למילים האחרות במשפט לאחר ההכפלה של כל אחת מהם ברשת השלישית (<strong>K</strong>ey)).</p>
<h1><a class="anchor-offset" name="מיקום"></a>מיקום</h1>
<p dir="rtl">בנוסף, צריך גם להכניס לוקטור שנוצר מהרשתות השניה והשלישית נתונים על המיקום במשפט שידע את המרחק בין המילים, היום עושים זאת בשיטת <strong>RoPE</strong>, מחלקים את הוקטורים לזוגות, הופכים כל זוג ל'זוית' על-ידי הגדרת מספר אחד למרחק ומספר אחד לגובה מנקודת אמצע, מכפילים את מספר המילה במשפט במספר הזוג בוקטור, והתוצאה זו הזוית שבה צריך לסובב את הזוג מהזוית שלהם, את הזוית החדשה הופכים לנתון גובה ומרחק, והם הופכים למספרים החדשים.</p>
<h1><a class="anchor-offset" name="ראשי-קשב"></a>ראשי קשב</h1>
<p dir="rtl">לא לוקחים את כל הוקטור המקורי ועושים עליו יחד את כל החשבון הזה, אלא מחלקים את הווקטור לכמה חלקים (-'ראשי קשב'), וכל חלק בנפרד (מהוקטור שיצא מהרשת השניה-Q) בודק מי המילים שהכי קרובות לו מהחלק הזה (מהוקטור שיצא מהרשת השלישית-K). רק אחרי שנוצרים כל החלקים השונים של הוקטור המאוחד מכל המילים, מצרפים את כל הוקטורים יחד ומעבירים דרך רשת רביעית שמאחדת אותם.<br />
אם המספר יצא גדול מידי, מקטינים אותו (על-ידי נוסחה, שכמה שהמספר יותר גדול מקטינים אותו יותר).<br />
לאחר שאנו יודעים כמה כל המילים במשפט השפיעו על המילה האחרונה (כולל היא עצמה), יוצרים שילוב מכל הוקטורים האלו (כל אחד מהוקטורים כמה שהוא קשור נותן % מהוקטור שנוצר על-ידי הרשת הראשונה), בודקים בוקטורים של כל המילים כמה כל אחת מהם רחוקה מהוקטור שיצא, המחשב ממיר את זה ל% (וכאן קובעת ה'<strong>טמפרטורה</strong>' - טמפרטורה נמוכה מתחת ל-1 מגדילה את הפער בין המילים וגורמת ל% גבוהים יותר למילים הכי מתאימות, וטמפרטורה של מעל 1 מפחיתה את הפער בין המילים). יש גם תוספות של <strong>top-k</strong> - בחירה אקראית רק מבין המילים עם הכי הרבה %, ו-<strong>top-p</strong> - בחירה אקראית רק מבין מילים שקיבלו לפחות % מסויים.</p>
<h1><a class="anchor-offset" name="חידושים-נוספים-מהשנים-האחרונות"></a>חידושים נוספים מהשנים האחרונות</h1>
<p dir="rtl"><strong>ארכיטקטורת MoE - תערובת של מומחים</strong><br />
בשנים האחרונות נוסף אחד מהשיפורים הגדולים בטרנספורמר - MoE, זה אומר שיש כמה רשתות גדולות בכל שכבה, וכל מילה עוברת רק בחלק מהם (הבחירה היא של רשת קטנה נוספת, שהיא הנתב, ולאחר המעבר בה, המחשב יודע לאיזו רשת להפנות את הוקטור. גם רשת זו עוברת כמובן אימון).<br />
<strong>Quantization (קוונטיזציה - כימות)</strong><br />
במקור, כל מספר (-פרמטר) ברשתות הנוירונים מיוצג ב-32 או 16 ביט, יש אפשרות לאחר גמר האימון לחתוך בחצי ואף יותר את כמות הביטים שהפרמטר תופס, מה שחוסך המון כוח חישוב ולא משפיע כל-כך על איכות המודל, יש קוונטיזציה לכל הגדלים - אפילו ל1, אבל הנפוצים הם 4 ו-8. יש גם סוגי כיווץ שמכוצים חלק יותר וחלק פחות בצורה חכמה.<br />
כמו-כן ניתן לעשות גם <strong>QAT</strong> - אימון מודע לכימות, שכבר בזמן האימון מאמנים על דעת לעגל את המספרים בגלל הכימות.</p>
<h1><a class="anchor-offset" name="האימון-בפועל"></a>האימון בפועל</h1>
<p dir="rtl">מאמנים על כמות עצומה של נתונים, בדרך-כלל טרליוני ואף עשרות טרליוני טוקנים, פעולה כזאת לוקחת תשתיות אדירות של מעבדים גרפיים ענקיים שעובדים יחד במשך חודשים, מחלקים את השכבות ואפילו את דוגמת האימון עצמה בין הרבה כרטיסים גרפיים. יש כמה טכניקות להאיץ את האימון, <strong>BF16</strong> - אימון מראש על פרמטרים שתופסים 16 ביטים בלבד, <strong>Flash Attention</strong> - יש בעיה באימון מודלים, כיון שכל הזמן המחשב צריך לחשב פרצמטרים שונים, המעבד לא עובד בשיא התפוקה כי לוקח זמן עד שהנתונים עוברים מהזיכרון שלו לחישוב, בשביל זה יש את Flash Attention שעושה את זה ביעילות הגדולה ביותר.</p>
<h1><a class="anchor-offset" name="צ-אט-בוט"></a>צ'אט-בוט</h1>
<p dir="rtl">איך כל זה הופך למה שאנו מכירים? כל מה שאנו פירטנו עושה שהמחשב יודע בחכמה לזהות מה הטוקן הבא שאמור להופיע אחרי משפט מסויים, וככה הוא יכול לכתוב ברצף טוקן אחר טוקן. אך המודל אומן על האינטרנט, על ידע, אז איך הוא יודע לענות: לגבי מה ששאלת... מהיכן הוא מכיר זאת? התשובה היא שלאחר האימון הגדול עושים כיונון למודל - מאמנים אותו לענות על שאלות, מכינים לו (או שמודל AI אחר מכין) כמויות של דוגמאות בסגנון: שאלה: למה יש לילה? תשובה: כי כדור הארץ מסתובב סביב צירו..., וכן גם דוגמאות של צ'אט ארוך עם שאלה-תשבת-שאלה-תשובה, וגם עוד כל מיני סוגים שונים של טקסטים של תשובה וכדומה, ובזמן השיחה, המערכת מכניסה לו מאחורי הקלעים לפני שאילת המשתמש את המילה <em>שאלה:</em>, ואחרי שאלת המשתמש את המילה <em>תשובה:</em>, גם מכינים לו הרבה דוגמאות של סירוב לענות לתוכן מזיק, פוגעני וכדומה. כמו-כן המודל מאומן לעצור כשהוא מגיע לסימן של סוף תשובה.<br />
שלב קריטי נוסף, זה העדפות משתמש, מייצרים 2 תשובות במודל על אותו שאלה, ואדם (או מודל AI אחר) מדרג אותם מה יותר טוב, בעבר השתמשו ב<strong>RLHF</strong> - פונקציה להעלאת הסבירות לתשובה הטובה יותר,כיום משתמשים ב<strong>DPO</strong>, שרק מצרף את התשובה הטובה כדוגמת אימון.<br />
שלב הכוונון יכול להתבצע גם לכל מודל שרוצים שהוא יענה יותר טוב/על נושא ספציפי.<br />
יש טכניקה בשם <strong>LoRA</strong> שבמקום לאמן בכוונון את כל הפרמטרים, מוסיפים שתי רשתות קטנות לכל רשת ורק אותם מאמנים.<br />
יש מודלים שעוברים <strong>זיקוק</strong> - לוקחים מודל, ומאמנים אותו מאפס (או כוונון) רק על תשובות שמודל אחר יצר.</p>
<h1><a class="anchor-offset" name="הזיות"></a>הזיות</h1>
<p dir="rtl">חשוב להבין, שכיון שהמודל לא בנוי על ידע אלא רק על הסתברות הטוקן הכי מתאים, הוא יכול להזות - לומר דברים שנראים אמיתיים בביטחון מלא, כשבפועל הם שקר גמור. בשביל להתגבר על זה (לפחות חלקית), יש אפשרות למודל לעשות חיפוש ב-<strong>RAG</strong> - מאגר טקסט (כמו האינטרנט), ולחפש טוקנים שדומים לוקטורים של הנושא, להכניס את התוצאות, כחלק מהשאלה, ועל-פי זה לענות תשובה (הוא מאומן גם על כאלו דברים), זה גם עוזר לו להגיע לחומר עדכני שלא היה קיים בזמן האימון שלו.</p>
<h1><a class="anchor-offset" name="חשיבה"></a>חשיבה</h1>
<p dir="rtl">אחד הדברים שהכי הקפיצו את איכות המודלים בשנים האחרונות, זה החשיבה - מאמנים את המודל על דוגמאות של חשיבה על השאלה ומה ואיך לענות ואז התשובה, זה מקפיץ דרמטית את יכולות המודל.</p>
<h1><a class="anchor-offset" name="kv-cache"></a>KV cache</h1>
<p dir="rtl">בזמן השיחה, כיון שמנבים מילה אחר מילה, שומרים בזיכרון את החישוב של המילים הקודמות שכבר חושבן כמה הערך שלהם (הרשת הראשונה), וכמה הם משפיעים (הרשת השניה), זה תופס הרבה מאז זיכרון. יש מודלים שמשתמשים ב<strong>GQA</strong> - ראשי קשב משתמשים באותם רשתות הראשונה והשניה.</p>
<h1><a class="anchor-offset" name="חלון-הקשר"></a>חלון הקשר</h1>
<p dir="rtl">עד איזה אורך של משפט המודל יכול לזכור אחורה? לכאורה הכל תלוי באימון, ואימון על חלון הקשר ארוך (מאות אלפי ואף מליוני טוקנים) הוא מורכב מאד, זה מוסיף כמויות כוח חישוב, בשביל זה יש כמה שיטות, ישנה שיטה להאריך את הקשר גם באורך שלא אומן (באיכות נמוכה), ויש גם ארכיטקטורות חדשות למודלים כמו <strong>mamda</strong> (שנוחות יותר לאורך הקשר גדול), שלפעמים משלבים אותם עם הטרנספורמר הרגיל, חלק שכבות ככה וחלק ככה.<br />
גם השיחה באורך הקשר גדול תופסת כמויות של זיכרון בגלל מטמון הKV.</p>
<h1><a class="anchor-offset" name="מולטי-מודאליות"></a>מולטי-מודאליות</h1>
<p dir="rtl">כיום רבים מבין המודלים יודעים גם לזהות יחד עם הטקסט, תמונות אודיו ווידאו, איך זה עובד? יש <strong>מקודד</strong> - שמחלק את התמונה לחלקים והופך אותה לטקסט קבוע, ואז זה נכנס למודל כמו טקסט רגיל. יש כיום גם מודלים שפועלים ללא מקודד, פשוט יש וקטורים של ראיה של התמונות, ויש וקטורים של הטקסט, והם משולבים יחד בחישובים.</p>
<h1><a class="anchor-offset" name="סוכנים"></a>סוכנים</h1>
<p dir="rtl">לאחרונה נפוץ מאד העבודה עם בוכנים שעושים פעולות במחשב לבד, הדרך של זה היא שאימנו את המודל לדוגמאות שבהם הוא צריך לעשות פעולות במחשב, לכל פעולה יש למחשב שם קוד לפעולה הזו, ותוכנה מתאימה מבינה את זה ועושה את הפעולה.</p>
<h1><a class="anchor-offset" name="המודלים"></a>המודלים</h1>
<p dir="rtl">בפועל, בשנים האחרונות נוצרו כמויות של מודלי שפה, שעולים ברמה מיום ליום, חברות משקיעות טרליונים בשביל להתחרות מי מייצרת את המודל הכי טוב. מי קובע מה מודל יותר טוב? יש כמה סוגי מבחנים שיצרו בשביל לקבוע את ציון המודל, יכול להיות גם מודל שטוב בדבר כזה וגרוע בדבר אחר, יש גם מדדים שנוצרים מהערכה של משתמשים שמקבלים 2 תשובות, ואומרים מה יותק טוב, בלי לדעת אם איזה מודל הם משתמשים.<br />
החברות שנמצאות היום בראש מדד המודלים, הם Anthropic, OpenAI, Google, SpaceXAI, Meta האמריקאיות, והחברות הסיניות Kimi, Alibaba, Z AI, DeepSeek ו- MiniMax.</p>
<h1><a class="anchor-offset" name="משקולות-פתוחות"></a>משקולות פתוחות</h1>
<p dir="rtl">בשונה מהחברות האמריקאיות שלרוב משאירות את מודלי הדגל אצלם, ונותנות להשתמש בהם דרך ממשק באתר או דרך קריאת API, החברות הסיניות ברובם מפרסמות את המודל, והוא ניתן לצפיה ולהורדה, מי שהתחילה את הסטדנדרט הזה היא דווקא חברת מטא עם סדרת llama שלה.<br />
כיון שהחברות מפרסמות רק את המודל המוכן ולא את הדרך להכין אותו, המודלים לא מוגדרים כקוד פתוח אלא כמשקולות פתוחות, החברה הכמעט יחידה שמפרסמת מודלים בקוד פתוח היא AllenAI עם סדרת OLMo שלה, היא מפרסמת בנוסף למודל גם את קוד האימון ואת נתוני האימון השונים.<br />
יש גם סוגי רשיונות שונים שבהם המודלים מפורסמים, הפתוח שבהם הוא Apache 2.0.</p>
]]></description><link>https://bina.top/topic/137/מדריך-איך-עובד-ה-ai-מאחורי-הקלעים-כולל-עיקרי-הארכיטקטורות-והטכנולוגיות-השונות.</link><generator>RSS for Node</generator><lastBuildDate>Fri, 11 Sep 2026 00:07:16 GMT</lastBuildDate><atom:link href="https://bina.top/topic/137.rss" rel="self" type="application/rss+xml"/><pubDate>Wed, 12 Aug 2026 02:53:42 GMT</pubDate><ttl>60</ttl><item><title><![CDATA[Reply to מדריך | איך עובד ה-AI מאחורי הקלעים, כולל עיקרי הארכיטקטורות והטכנולוגיות השונות. on Fri, 28 Aug 2026 11:01:43 GMT]]></title><description><![CDATA[<p dir="rtl"><a class="plugin-mentions-user plugin-mentions-a" href="/user/%D7%94%D7%9E%D7%9C%D7%90%D7%9A" aria-label="Profile: המלאך">@<bdi>המלאך</bdi></a> <a href="/post/1823">כתב</a>:</p>
<blockquote>
<p dir="rtl">וודאי שכן.<br />
זה לא ׳קוד פתוח׳ כי הם לא משחררים את נתוני האימון.<br />
בדיוק כמו מטא.</p>
</blockquote>
<p dir="rtl">כמובן, טעות שלי, התכוונתי לקוד פתוח, משקולות פתוחות יש להרבה מודלים.</p>
]]></description><link>https://bina.top/post/2516</link><guid isPermaLink="true">https://bina.top/post/2516</guid><dc:creator><![CDATA[יש לי מושג]]></dc:creator><pubDate>Fri, 28 Aug 2026 11:01:43 GMT</pubDate></item><item><title><![CDATA[Reply to מדריך | איך עובד ה-AI מאחורי הקלעים, כולל עיקרי הארכיטקטורות והטכנולוגיות השונות. on Wed, 12 Aug 2026 12:29:40 GMT]]></title><description><![CDATA[<p dir="rtl"><a class="plugin-mentions-user plugin-mentions-a" href="/user/%D7%99%D7%A9-%D7%9C%D7%99-%D7%9E%D7%95%D7%A9%D7%92" aria-label="Profile: יש-לי-מושג">@<bdi>יש-לי-מושג</bdi></a> <a href="/post/1821">כתב</a>:</p>
<blockquote>
<p dir="rtl">זה לא מוגדר כמשקולות פתוחות, כי הם לא משחררים הכל.</p>
</blockquote>
<p dir="rtl">וודאי שכן.<br />
זה לא ׳קוד פתוח׳ כי הם לא משחררים את נתוני האימון.<br />
בדיוק כמו מטא.</p>
]]></description><link>https://bina.top/post/1823</link><guid isPermaLink="true">https://bina.top/post/1823</guid><dc:creator><![CDATA[המלאך]]></dc:creator><pubDate>Wed, 12 Aug 2026 12:29:40 GMT</pubDate></item><item><title><![CDATA[Reply to מדריך | איך עובד ה-AI מאחורי הקלעים, כולל עיקרי הארכיטקטורות והטכנולוגיות השונות. on Wed, 12 Aug 2026 12:10:05 GMT]]></title><description><![CDATA[<p dir="rtl"><a class="plugin-mentions-user plugin-mentions-a" href="/user/%D7%90.%D7%9E.%D7%93." aria-label="Profile: א.מ.ד.">@<bdi>א.מ.ד.</bdi></a> <a href="/post/1780">כתב</a>:</p>
<blockquote>
<p dir="auto">AllenAI.</p>
</blockquote>
<p dir="rtl">תוקן.</p>
<blockquote>
<p dir="rtl"><a class="plugin-mentions-user plugin-mentions-a" href="/user/%D7%90.%D7%9E.%D7%93." aria-label="Profile: א.מ.ד.">@<bdi>א.מ.ד.</bdi></a> <a href="/post/1780">כתב</a>:</p>
<p dir="rtl">גם אנבידיה משחררת חלק גדול ממערך האימון.</p>
</blockquote>
<p dir="rtl">זה לא מוגדר כמשקולות פתוחות, כי הם לא משחררים הכל.</p>
]]></description><link>https://bina.top/post/1821</link><guid isPermaLink="true">https://bina.top/post/1821</guid><dc:creator><![CDATA[יש לי מושג]]></dc:creator><pubDate>Wed, 12 Aug 2026 12:10:05 GMT</pubDate></item><item><title><![CDATA[Reply to מדריך | איך עובד ה-AI מאחורי הקלעים, כולל עיקרי הארכיטקטורות והטכנולוגיות השונות. on Wed, 12 Aug 2026 08:54:32 GMT]]></title><description><![CDATA[<p dir="rtl"><a class="plugin-mentions-user plugin-mentions-a" href="/user/%D7%99%D7%A9-%D7%9C%D7%99-%D7%9E%D7%95%D7%A9%D7%92" aria-label="Profile: יש-לי-מושג">@<bdi>יש-לי-מושג</bdi></a> <a href="/post/1761">כתב</a>:</p>
<blockquote>
<p dir="auto">AI2</p>
</blockquote>
<p dir="auto">AllenAI.<br />
ויש גם חברות נוספות. גם אנבידיה משחררת חלק גדול ממערך האימון.</p>
]]></description><link>https://bina.top/post/1780</link><guid isPermaLink="true">https://bina.top/post/1780</guid><dc:creator><![CDATA[א.מ.ד.]]></dc:creator><pubDate>Wed, 12 Aug 2026 08:54:32 GMT</pubDate></item><item><title><![CDATA[Reply to מדריך | איך עובד ה-AI מאחורי הקלעים, כולל עיקרי הארכיטקטורות והטכנולוגיות השונות. on Wed, 12 Aug 2026 02:55:33 GMT]]></title><description><![CDATA[<p dir="rtl">ניתן להציע תיקונים, תוספות ושיפורים, ואני אכניס אותם לסקירה</p>
]]></description><link>https://bina.top/post/1762</link><guid isPermaLink="true">https://bina.top/post/1762</guid><dc:creator><![CDATA[יש לי מושג]]></dc:creator><pubDate>Wed, 12 Aug 2026 02:55:33 GMT</pubDate></item></channel></rss>