דילוג לתוכן

חדשות בלבד ללא תגובות

חדשות מודלי הai
3 2 61 4
  • מטא משיקה את המתחרה שלה לקלוד קוד

    מטא השיקה את המתחרה שלה לקלוד קוד – Muse Code. מדובר במוצר שנבנה על גבי מודל Muse Spark 1.2 של החברה, ומשוחרר תחילה רק בבטא. הכלי החדש מנסה להיכנס לספייס המאוד צפוף בין קלוד קוד, Codex וכלים כמו Cursor שעוזרים למשתמשים לכתוב קוד בעזרת AI. מטא מצליחה להגיע לתחום גם אחרי xAI של אילון מאסק שהשיקה בשבועות האחרונים את Grok Build שעושה את אותו הדבר.

    מקור: גיקטיים

  • מטא חוזרת להוציא מודלי שפה בקוד פתוח, והפעם בסדרת Muse

    מטא חלוצת מודלי השפה הפתוחים, שהוציאה בעבר את סדרת המודלים Llama 1-4, ועברה בחודשים האחרונים להתמקד במודלים סגורים עם פרסום מודל Muse Spark שלה, כעת מוציאה את Muse Glimmer, מודל בעל משקולות פתוחות עם 30B פרמטרים.
    עם פרסומו, המודל מככב בצמרת המודלים הקטנים (עד 40B)
    cad2316b-cc5f-4a80-8e86-ea642771f2f2-image.jpeg
    מקור: artificial analysis

  • NVIDIA משחררת את המודל Nemotron 3.5 Lightning

    חברת NVIDIA ללא ספק ממובילות התפתחות הבינה-המלאכותית בזכות המעבדים הגרפיים האדירים שהיא מייצרת, אשר משמשים ליצור והפעלת רוב מוחלט של מודלי ה-AI בעולם, אולם בשנתיים האחרונות, NVIDIA הצטרפה למירוץ מודלי הAI ומפרסמת מודלים במשקולות פתוחות. תחילה היו אלו מודלים Llama הפתוחים של מטא שעברו אימונים נוספים לכיונון על-ידי אנבידיה, ואחר-כך בסדרת Nemotron (נמוטרון) העצמאית.
    כעת יוצא המודל הראשון בסדרת 3.5, כשהוא מגיע בגודל 31.6B פרמטרים, בארכיטקטורת MoE עם 3.6B פרמטרים פעילים, מה שגורם שאפשר להריץ אותו על מחשב עם 32 ראם ו4 VRAM במהירות גבוהה, או אפילו על מחשב עם 8 ראם בלבד עם SparkMoE של @א.מ.ד.
    המודל מגיע לביצועים גבוהים ביחס לגודלו ולפרמטרים הפעילים שלו, לפניו נמצאים רק Qwen 35B A3B, G9v3-39A5B, Gemma 4 26B A4B, ואם מתייחסים למדדי קידוד, Qwen 35B A3B הוא היחיד שעוקף אותו.
    כמו כל המודלים מסדרת Nemotron, הם משלבים של טרנספורמר הרגיל, ושכבות של ארכיטקטורת mamda החדשה. כמו-כן, החברה מפרסמת את קודי האימון, וכן חלק מנתוני האימון, אך כיון שלא כל הנתונים מפורסמים, המודל עדין לא מוגדר כ'קוד פתוח', אלא כ'משקולות פתוחות'.

    לכל המנוטפרים החדשים בתחום, שימו לב שהורדת מודלים חסומה בנטפרי


קרא עוד