דילוג לתוכן

חדשות בלבד ללא תגובות

חדשות מודלי הai
16 5 304 9
  • Qwen3.8 27B

    חברת Alibaba הסינית השיקה ב-18 באוגוסט את המודל הקטן יותר של סדרת Qwen 3.8, בגודל 27B פרמטרים.
    המודל מגיע בכמה רמות של חשיבה, וברמה הגבוהה הוא מגיע במדדי הביצועים למקום לא-יאומן עבור מודל בכזה גודל, כשהוא עוקף שורה ארוכה של מודלי-על ענקיים, ובפרט ביכולות קידוד הוא מוצלח, שם הוא נמצא ממש בצמרת המודלים המובילים בעולם.e2c55b20-aa24-40fc-8e71-3eb2c168cffc-image.jpeg d4bf5483-bd00-4d61-8504-80417fabfc7c-image.jpeg

  • אנת'רופיק השיקה את המודל Claude Fable 5.1

    כידוע מודל הדגל המוביל בעולם כבר כמה חודשים הוא Claude של חברת Anthropic, המודל קיים בכמה סוגים: Mythos (מיתוס), Fable (פייבל), Opus (אופוס), Sonnet (סונט), Haiku (איקיו).
    עקב העוצמה של המודל Mythos, הוא חסום לשימוש למשתמשים רגילים, והמודל Fable הוא בעצם גירסה בטוחה של Mythos.
    בכל מודל יש כמה רמות של חשיבה: Low (נמוך), Medium (בינוני), High (גבוה), Extra (אקסטרה), Max (מקסימום).
    כעת יצאה גירסה חדשה למודלים Fable ו-Mythos המודלים החדשים הם: Claude Fable 5.1, ו-Claude Mythos 5.1. בשונה מ-Claude Fable 5, שאותו עקף Claude Opus 5 ברוב המדדים, Claude Fable 5.1 מציג קפיצה משמעותית בביצועים השונים, ניתן לראות את הציון שלו (ברמת חשיבה מקסימלית) ביחס למודלים המובילים בעולם.Artificial Analysis Intelligence Index (4 Sep '26).jpeg
    וזה התוצאות בציון של סוכן קודArtificial Analysis Coding Agent Index (4 Sep '26).jpeg

  • Gemini 3.8 Flash

    גוגל הוציאה גרסה חדשה של המודל המהיר שלהם - Gemini 3.8 Flash, המודל מציג עליה במדדים ביחס לדורות הקודמים, אך עדיין לא מגיע לרמה של מודלי הצמרת.Artificial Analysis Intelligence Index (4 Sep '26) (1).jpeg

  • Meta מוציאה את Muse Spark 1.3

    חברת הענק האמריקאית Meta מגיעה לפסגה עם הוצאת הגירסה החדשה של מודל הדגל שלהם Muse Spark, המודל מתקדם כמה רמות במדדים השונים, ובגירסת ה-Max שלו שעדיין לא שוחררה לציבור הוא מגיע למקום השלישי - רק אחרי Claude Fable 5.1 ו-Claude Opus 5 של Anthropic.Artificial Analysis Intelligence Index (4 Sep '26) (2).jpeg

  • GPT-6 Astra

    חברת OpenAI מוציאה דור חדש בסדרת המודלים GPT-6, והפעם בסדרת Astra.
    GPT-5.6 עדיין הוא הגירסה העדכנית של הסדרות Sol, Terra ו-Luna.
    השוואה בין סדרות שונות, גירסאות שונות ורמות חשיבה שונות של המודל GPT:
    Artificial Analysis Intelligence Index (4 Sep '26) (3).jpeg

  • image.jpeg

  • Claude Opus 5.5

    לפי artificial analysis, הוא מציג קפיצה מטורפת, גם ביחס לפייבל 5.1 - 5 נקודות יותר!
    Artificial Analysis Intelligence Index (22 Sep '26).png

  • שתי חברות סיניות נכנסו למודלים המובילים

    חברת Xiaomi (חטיבת ה-AI של שיאומי) הפתיעה בגדול, שכשהיא הוציאה את הדור החדש של המודל שלהם - MiMo-V2.6-Pro, והוא מייצג קפיצה אדירה ביחס לדור הקודם.
    החברה שעד היום לא הציגה ביצועים יוצאי דופן, קופצת ישר לראש ומגיעה למודל בעל המשקולות הפתוחות הטוב יותר בעולם, וכן הוא גם המודל הסיני הכי טוב כיום. המודל מתמקם בצמרת המודלים המובילים בעולם, רק מתחת לקלוד, GPT, Muse וGrok.

    חברה נוספת, לא כל-כך מוכרת נוספת שהמודל שלה הגיע למקומות הראשונים, זו חברת StepFun שהוציאה את המודל Step 5 שמקבל ציון משוקלל של 44 במדד של artificial analysis, שזה 3 נקודות מעל ג'מיני 3.8.

  • בהפרש של דקות מ- Claude Opus 5.5, חברת OpenAI מוציאה את הדור החדש - GPT-6 של המודלים Sol ו- Luna.
    לפי המדדים הראשונים, לא רואים עליה משמעותית בביצועים על-פני GPT-5.6.

  • DeepSeek V4.1 Flash ללא חשיבה

    בעולם שבו המודלים חושבים יותר ויותר לפני כל תשובה או ביצוע משימה, יש משמעות גדולה למודל שמצליח להגיע לתוצאות טובות עם עצם המוח הפשוט שלו ללא חשיבה, בפרט עבור חברות שרוצות להריץ מודלים מקומית, ואין להם אפשרות לתשובות באורך אסטרונומי. כזה הוא המודל החדש של חברת DeepSeek הסינית.
    לפני כמה ימים החברה השיקה את הדור החדש של מודל הפלאש שלה - DeepSeek V4.1 Flash, אשר עקף ברמת חשיבה מקסימלית את מודל הפרו מאותו דור באותה רמת חשיבה. כעת התפרסמו התוצאות של המודל הזה כשהוא ללא חשיבה והוא מגיע למקום הראשון בעולם מבין המודלים בקוד פתוח ללא חשיבה.

  • Gemini 4 בדרך — מה צפוי במודל החדש

    גוגל אישרה רשמית כי המודל הבא בסדרת Gemini נמצא כעת בשלבי אימון וכיול מתקדמים (Post-training), וייתכן שיושק עוד לפני סוף השנה — מוקדם מהתחזית המקורית.

    ⚠️ חשוב להבהיר: גוגל לא פרסמה עדיין מפרט רשמי, שם מודל סופי, תאריך השקה או יכולות מאושרות. כל מה שמפורט למטה הן ערכות בלבד של אנליסטים וגורמים בתעשייה, המבוססות על מגמת הפיתוח של גוגל ולא על הודעה רשמית.

    מה מעריכים שנראה במודל החדש:

    🔹 סוכנים אוטונומיים (Agentic AI)— הערכה שהמודל יתמקד ביכולת לנהל משימות מורכבות לאורך זמן: לתכנן, לבצע, לזהות טעויות ולתקן אותן בעצמו, ולא רק לענות על שאלות.

    🔹 הסקה מעמיקה (Deep Reasoning) — צפי לשיפור ביכולת "לחשוב לפני שעונים", כדי לצמצם טעויות עובדתיות ומתמטיות.

    🔹 מולטימודליות משופרת— הערכות מדברות על שילוב חלק יותר בין וידאו, אודיו וטקסט, כולל אפשרות להבנת וידאו בזמן אמת.

    גורמים בתעשייה מעריכים שהשקת המודל לציבור הרכב צפוי באוקטובר–דצמבר 2026, אך זו הערכה בלבד ולא תאריך רשמי.


קרא עוד