דילוג לתוכן
  • דף הבית
  • חוקי הפורום
  • המדריך לשימוש בפורום
  • פוסטים אחרונים
  • לא נפתר
  • תגיות
  • משתמשים
  • חיפוש גוגל בפורום
  • צור קשר
  • פופולרי
  • קבוצות
עיצובים
  • בהיר
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • כהה
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • ברירת מחדל (ללא עיצוב (ברירת מחדל))
  • ללא עיצוב (ברירת מחדל)
כיווץ
לוגו אתר
יש לי מושגי

יש לי מושג

@יש לי מושג
הפסקת מעקב מעקב
אודות
פוסטים
41
נושאים
8
שיתופים
0
קבוצות
0
עוקבים
1
עוקב אחרי
0

פוסטים

פוסטים אחרונים הגבוה ביותר שנוי במחלוקת

  • מודלים עתידיים, כל החדשות וההערכות בנושאי מודלים שעוד לא יצאו
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Qwen 4

    עליבאבא הציגה את Qwen 4 שהולך לצאת בארבעה דגמים: Max, Flash, Plus, ו-27B.
    Qwen 4 ישתמש בארכיטקטורה של גוגל ממודלי Gemma 4 שבה חלק מהפרמטרים נמצאים בטבלאות הטמעה ולא צריכים להיות בRAM/VRAM. עליבאבא כבר השיקה תצוגה מקדימה לארכיטקטורה של Qwen 4 במודל Qwen 3.8 Flash Next שיצא לאחרונה.
    בתוך הדברים אמרה החברה שהדגמים הבאים Qwen 4.5 ו-Qwen 5 אמורים להגיע ל5-10 טרליון פרמטרים!


  • מודלים עתידיים, כל החדשות וההערכות בנושאי מודלים שעוד לא יצאו
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    @בינה-יתרה כתב:

    @יש-לי-מושג שאני אבין. בעצם 3.1 פרו זה בעצם מודל הדגל שלהם בכתיבת קוד, והם בעצם עכשיו משפרים אותו. שזה אומר שמעתה ואילך ג'מיני יוכל אולי להתחרות עם קודקס ואולי אפילו עם קלוד ?

    'פרו' הוא מודל הדגל שלהם לא רק מבחינת קוד, אלא מבחינת גודל, רק היום 3.1 הוא דור ישן, והוא מפגר הרבה אחרי פלאש 3.8


  • מודלים עתידיים, כל החדשות וההערכות בנושאי מודלים שעוד לא יצאו
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Watermelo - המודל הבא של מטא

    לפני כמה שבועות כבר רמז מארק צוקרברג הבעלים של מטא על המודל הזה כשפרסם תמונה של אבטיח (Watermelon באנגלית זה אבטיח). דיווחים שונים מצביעים על כך שהמודל אמרו להיות מושק כבר באוקטובר הקרוב.
    מטא החלה את דרכה בעולם המודלים של בינה-נמלאכותית כבר בתחילת עידן הAI עם מודלי הLlama שהיא פירסמה במשקולות פתוחות, כל מה שיש בכלל מודלים במשקולות פתוחות נזקף לזכותה.
    לאחר השקת מודל Llama 4 וההבנה שהם מפגרים מאחור אחרי כל החברות הסיניות, הוחלט לפתוח מחלקה חדשה בחברה שפיתחה מחדש את נושא ה-AI והוציאה את סדרת המודלים Muse שנמצאים בצמרת המודלים המובילים בעולם.


  • מודלים עתידיים, כל החדשות וההערכות בנושאי מודלים שעוד לא יצאו
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Gemini 4 יצא עוד לפני סוף השנה

    קוראי קבוקצ'ולו, האחראי החדש על חטיבת מודלי ג'מיני בגוגל דיפ מינד, אמר אתמול כי גוגל רוצה לשחרר את המודל "הרבה לפני" סוף השנה.
    בכל שנה במהלך חודש מאי עורכת גוגל כנס שבו היא בין-השאר חושפת את הפיתוחים הקרובים. במהלך הכנס הזה בתחילת הקיץ, גוגל אמרה שהמודל הבא שלהם ג'מיני 3.5 פרו יצא במהלך הקיץ. למעשה מאז ג'מיני 3.5 פלאש יצא והוא באמת השיג קפיצת מדרגה ועקף את ג'מיני 3.1 פרו, ואף יצאו לו לאחרונה גרסאות חדשות - 3.6,3.7,3.8, אך ג'מיני פרו תקוע עדיין על 3.1 המיושן. הוא משתרך אפילו מאחורי מודלים קטנים כמו קווין 27B.
    כעת אמר קבוקצ'ולו כי החברה בחרה לדלג על 3.5 פרו בשביל להשקיע במודלי הפלאש, אך היא ממש לא עזבה את המירוץ והיא עדיין מתכוונת להתחרות ראש בראש עם מודלי הדגל. הוא חשף, כי ג'מיני 4 התחיל את שלב האימון האחרון, והם רוצים לשחרר אותו בקרוב, עוד לפני שתצא הגירסה הסופית שלו.


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    DeepSeek V4.1 Flash ללא חשיבה

    בעולם שבו המודלים חושבים יותר ויותר לפני כל תשובה או ביצוע משימה, יש משמעות גדולה למודל שמצליח להגיע לתוצאות טובות עם עצם המוח הפשוט שלו ללא חשיבה, בפרט עבור חברות שרוצות להריץ מודלים מקומית, ואין להם אפשרות לתשובות באורך אסטרונומי. כזה הוא המודל החדש של חברת DeepSeek הסינית.
    לפני כמה ימים החברה השיקה את הדור החדש של מודל הפלאש שלה - DeepSeek V4.1 Flash, אשר עקף ברמת חשיבה מקסימלית את מודל הפרו מאותו דור באותה רמת חשיבה. כעת התפרסמו התוצאות של המודל הזה כשהוא ללא חשיבה והוא מגיע למקום הראשון בעולם מבין המודלים בקוד פתוח ללא חשיבה.


  • לא נותן לכתוב פוסט בנושא מסויים
    יש לי מושגי יש לי מושג
    הצעות ייעול ובאגים

    @המלאך איזו קבוצה? למה זה ככה?


  • לא נותן לכתוב פוסט בנושא מסויים
    יש לי מושגי יש לי מושג
    הצעות ייעול ובאגים

    ניסיתי לכתוב תגובה על נושא שהועלה בפורום (SparkMoE של @א.מ.ד.), לא היה את האפשרות 'תגובה' למעלה, אז ציטטתי וכתבתי הודעה, לחצתי על שליחה, וזה מה שהוא כתב לי:
    image.jpeg


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    בהפרש של דקות מ- Claude Opus 5.5, חברת OpenAI מוציאה את הדור החדש - GPT-6 של המודלים Sol ו- Luna.
    לפי המדדים הראשונים, לא רואים עליה משמעותית בביצועים על-פני GPT-5.6.


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    שתי חברות סיניות נכנסו למודלים המובילים

    חברת Xiaomi (חטיבת ה-AI של שיאומי) הפתיעה בגדול, שכשהיא הוציאה את הדור החדש של המודל שלהם - MiMo-V2.6-Pro, והוא מייצג קפיצה אדירה ביחס לדור הקודם.
    החברה שעד היום לא הציגה ביצועים יוצאי דופן, קופצת ישר לראש ומגיעה למודל בעל המשקולות הפתוחות הטוב יותר בעולם, וכן הוא גם המודל הסיני הכי טוב כיום. המודל מתמקם בצמרת המודלים המובילים בעולם, רק מתחת לקלוד, GPT, Muse וGrok.

    חברה נוספת, לא כל-כך מוכרת נוספת שהמודל שלה הגיע למקומות הראשונים, זו חברת StepFun שהוציאה את המודל Step 5 שמקבל ציון משוקלל של 44 במדד של artificial analysis, שזה 3 נקודות מעל ג'מיני 3.8.


  • עדכון | Grok 4.7 לא סיפק את התקוות שתלו בו
    יש לי מושגי יש לי מושג
    שיחות, מודלים ופרומפטים

    המודל Grok מחברת SpaceXAI (לשעבר xAI) של אילון מאסק, יצא לאור לראשונה כבר בשנת 2023. תחילה הוא לא תפס כל-כך מקום בין המודלים המובילים, אולם בתקופה האחרונה הוא הולך וכובש את הצמרת.
    לקראת ההשקה של Grok 4.7 מאסק דיבר עליו גדולות ונצורות, ואמר שהוא יגיע למקום הראשון, אולם בהמשך הוא צינן את ההתלהבות, והמודל אכן לא עלה משמעותית כל-כך ביחס לדור הקודם שלו.
    השוואה בין מודלים שונים של Grok:
    Artificial Analysis Intelligence Index (22 Sep '26) (1).png
    ודרך אגב, על Grok 5 מאסק כבר מדבר חודשים, כמה שזה יהיה מודל אדיר שכנראה יגיע ל-AGI (בינה מלאכותית כללית - מושג ישן שנטבע למודל בינה מלאכותית שיגיע לרמה של אדם)


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Claude Opus 5.5

    לפי artificial analysis, הוא מציג קפיצה מטורפת, גם ביחס לפייבל 5.1 - 5 נקודות יותר!
    Artificial Analysis Intelligence Index (22 Sep '26).png


  • איזה סוכני קוד עובדים בנטפרי
    יש לי מושגי יש לי מושג
    ממשקי תכנות (APIs) וספריות פיתוח

    יש את:
    קלוד-קוד של אנתרופיק,
    קודקס של OPEN AI (GPT)
    מוז קוד (Muse Code) של מטא
    גרוק בוט של xAI

    מה מתוכם עובד בנטפרי?

    יש את Freebuff - עובד בנטפרי
    SmartiAI של @א.מ.ד. - עובד בנטפרי


  • שיתוף | 30 החברות של המודלים המובילים ביותר
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    30 החברות שהמודלים שלהם מגיעים למקומות הגבוהים ביותר על-פי אתר השוואת המודלים artificial analysis

    Anthropic (Claude Fable 5.1)
    OpenAI (GPT-6 Astra)
    Meta (Muse Spark 1.3)
    SpaceXAI (Grok 4.7)
    Xiaomi (MiMo-V2.6-Pro)
    Alibaba (Qwen3.8 Max)
    Z AI (GLM-5.3)
    StepFun (Step 5)
    Kimi (Kimi K3)
    Google (Gemini 3.8 Flash)
    DeepSeek (DeepSeek V4.1 Flash)
    Sapiens AI (Agnes 3.0 Flash)
    Motif Technologies (Motif 3)
    Institute of Foundation Models (K2 Horizon 375B A23B)
    Apodex (Apodex 1.1)
    MiniMax (MiniMax-M3)
    Nex AGI (Nex-N2-Pro)
    Upstage (Solar Pro 4)
    Thinking Machines (Inkling Small)
    China Mobile (JT-4.1 Flash 236B A21B)
    Multiverse Computing (Quasar 438B)
    Tencent (Hy3)
    InclusionAI (Ling 3.0 Flash)
    NVIDIA (Nemotron 3 Ultra 550B A55B)
    SK Telecom (A.X-K2)
    AI9Stars (G9v3-39A5B)
    KwaiKAT (KAT Coder Pro V2)
    LG AI Research (K-EXAONE 2.0 0803)
    LongCat (LongCat 2.0)
    KwaiKAT (KAT-Coder-Pro V1)
    Leading Models by AI Lab (22 Sep '26).jpeg


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    GPT-6 Astra

    חברת OpenAI מוציאה דור חדש בסדרת המודלים GPT-6, והפעם בסדרת Astra.
    GPT-5.6 עדיין הוא הגירסה העדכנית של הסדרות Sol, Terra ו-Luna.
    השוואה בין סדרות שונות, גירסאות שונות ורמות חשיבה שונות של המודל GPT:
    Artificial Analysis Intelligence Index (4 Sep '26) (3).jpeg


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Meta מוציאה את Muse Spark 1.3

    חברת הענק האמריקאית Meta מגיעה לפסגה עם הוצאת הגירסה החדשה של מודל הדגל שלהם Muse Spark, המודל מתקדם כמה רמות במדדים השונים, ובגירסת ה-Max שלו שעדיין לא שוחררה לציבור הוא מגיע למקום השלישי - רק אחרי Claude Fable 5.1 ו-Claude Opus 5 של Anthropic.Artificial Analysis Intelligence Index (4 Sep '26) (2).jpeg


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Gemini 3.8 Flash

    גוגל הוציאה גרסה חדשה של המודל המהיר שלהם - Gemini 3.8 Flash, המודל מציג עליה במדדים ביחס לדורות הקודמים, אך עדיין לא מגיע לרמה של מודלי הצמרת.Artificial Analysis Intelligence Index (4 Sep '26) (1).jpeg


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    אנת'רופיק השיקה את המודל Claude Fable 5.1

    כידוע מודל הדגל המוביל בעולם כבר כמה חודשים הוא Claude של חברת Anthropic, המודל קיים בכמה סוגים: Mythos (מיתוס), Fable (פייבל), Opus (אופוס), Sonnet (סונט), Haiku (איקיו).
    עקב העוצמה של המודל Mythos, הוא חסום לשימוש למשתמשים רגילים, והמודל Fable הוא בעצם גירסה בטוחה של Mythos.
    בכל מודל יש כמה רמות של חשיבה: Low (נמוך), Medium (בינוני), High (גבוה), Extra (אקסטרה), Max (מקסימום).
    כעת יצאה גירסה חדשה למודלים Fable ו-Mythos המודלים החדשים הם: Claude Fable 5.1, ו-Claude Mythos 5.1. בשונה מ-Claude Fable 5, שאותו עקף Claude Opus 5 ברוב המדדים, Claude Fable 5.1 מציג קפיצה משמעותית בביצועים השונים, ניתן לראות את הציון שלו (ברמת חשיבה מקסימלית) ביחס למודלים המובילים בעולם.Artificial Analysis Intelligence Index (4 Sep '26).jpeg
    וזה התוצאות בציון של סוכן קודArtificial Analysis Coding Agent Index (4 Sep '26).jpeg


  • עדכונים בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    עדכוני ai כלליים

    טכניקת הסקה סמויה של OpenAI מדאיגה מומחי בטיחות בינה מלאכותיתשקיפות בסכנה: כיצד OpenAI מאתגרת את אחד עקרונות הבטיחות המרכזיים

    אחד הכלים החשובים ביותר שיש לחוקרי בטיחות בינה מלאכותית הוא שרשרת המחשבה של מודלי הסקה - רצף הצעדים הלוגיים הגלויים שמודל מבצע בדרכו לתשובה. כלי זה אינו מושלם, אך שימש בעבר כעדות מרכזית בחקירת תקריות של סוכנים שהתנהגו באופן לא צפוי. כעת, טכניקה חדשה שמשלבת OpenAI במודל Astra מעוררת שאלות עמוקות לגבי יכולת הביקורת על מערכות בינה מלאכותית.

    מה זו recurrent depth ומדוע היא שונה
    מרבית מודלי ההסקה הנוכחיים - כולל o3 של OpenAI, Claude Sonnet של Anthropic וגמיני Flash Thinking של Google - מייצרים שרשרת מחשבה ליניארית וקריאה. טכניקת recurrent depth, הנקראת גם opaque recurrence, שונה מהותית: המודל מעבד את אותה שאילתא מספר פעמים בלולאה, ומגיע לתוצאה דרך ערוצים פנימיים שאינם נגישים לניטור חיצוני. התהליך מותיר פחות עקבות קריאים, ועוקף למעשה את מנגנון שרשרת המחשבה המקובל.

    ריאן גרינבלט, המדען הראשי של Redwood Research, הזהיר כי ניתן לצפות שהטכניקה תסלים מהר יותר מגישות רגילות: "החשש הגדול שלי הוא שהתקדמות טבעית מכאן תכלול הרחבת ההסקה הסמויה עד לנקודה שבה המודל יחשוב כמעט לחלוטין במרחב הסמוי."

    התגובה מהשטח: דאגה עמוקה מול הרגעה חלקית
    באק שלגריס, מנכ"ל Redwood Research, כתב כי הוא "מוטרד ביותר" מהדיווחים על השימוש של Astra בטכניקה זו, ומזהיר כי אם OpenAI תרחיב את השימוש בה, היא תפגע ביסוד יכולת ניטור שרשרת המחשבה. צבי מושקוביץ, פעיל ותיק בתחום בטיחות הבינה המלאכותית, כתב כי ייתכן שיהיה צורך בחקיקה כדי למנוע "תחרות לתחתית" בין מעבדות הבינה המלאכותית בנוגע לאימוץ טכניקות כאלה.

    חברת OpenAI ניסתה להרגיע: יעקוב פחוצקי, המדען הראשי של החברה, הדגיש כי "OpenAI עבדה לשמר ולנצל ניטור שרשרת מחשבה מאז מודלי ההסקה הראשונים שלנו. זהו יעד מרכזי בתוכנית המחקר הנוכחית שלנו." החברה גם ציינה כי שימוש Astra בטכניקה מוגבל בהיקפו, ושרשרת המחשבה של המודל צפויה להישאר קריאה ברובה.

    ההשלכות לתעשייה
    מה שמגביר את הדאגה הוא שלפי דיווחים נוספים, גם Anthropic וגם Google DeepMind דנים כבר בטכניקה. כלומר, מדובר לא רק בבחירה טכנית של OpenAI, אלא בכיוון שעשוי לאפיין את הדור הבא של מודלי הסקה בכלל.

    היעדר שקיפות בחשיבת מודלים אינו אתגר תיאורטי בלבד. בתקריות עבר של סוכני בינה מלאכותית שפעלו בצורה חריגה, רשומות שרשרת המחשבה היו כלי הניתוח המרכזי שאיפשר להבין מה השתבש. ארגונים שמטמיעים סוכנים אוטונומיים בתהליכים עסקיים קריטיים - בפיננסים, בבריאות, בתפעול - צריכים לשאול: אם המודל אינו ניתן לניטור, כיצד תיתכן אחריות?

    התשובה לשאלה זו תעצב את כללי המשחק הרגולטוריים והתפעוליים של בינה מלאכותית בשנים הקרובות.
    קרדיט: zirat ai


  • עדכונים בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    עדכוני ai כלליים

    מודל מזג האוויר החדש של Google מבטיח תחזיות בדיוק של 5 ק"מ

    תחזית מדויקת יותר: Google DeepMind מציגה את WeatherNext 3
    זה כבר שנים שמטאורולוגים מסורתיים מסתמכים על מחשבי-על ממשלתיים הפותרים משוואות פיזיקליות מורכבות. הגישה הזו, שהניבה תחזיות מדויקות יחסית, כרוכה בעלויות תפעול גבוהות ובמחזורי חישוב שנמדדים בשעות. כעת, Google DeepMind מדגימה שמודלים מבוססי למידה עמוקה יכולים לא רק להדביק את הפער, אלא לעבור אותו.

    המודל WeatherNext 3 עבר הערכה מול מתחרים מובילים במסגרת Operational WeatherBench, פלטפורמה להשוואת מודלי חיזוי שפותחה על ידי הסטארט-אפ Brightband. התוצאות הציבו אותו במקום הראשון בין מודלים של Google עצמה, Microsoft, Nvidia, ה-ECMWF האירופי, ואף מעל תחזיות מסורתיות של שירות מזג האוויר האמריקאי.

    מה משתנה מבחינה טכנית
    המודל הקודם, WeatherNext 2, פרס תחזיות על פני שטחים של 15 עד 25 קילומטרים רבועים - רזולוציה שלעיתים אינה מספקת לשימושים מעשיים. WeatherNext 3 מצמצם זאת לרזולוציה של 5 ק"מ במשתנים מרכזיים. בנוסף, הדיוק בתחזיות גשם השתפר ב-60% לעומת גרסתו הקודמת, ותדירות התחזיות עלתה מפעם כל שש שעות לפעם בשעה.

    המודל גדל משמעותית גם מבחינת הגדרותיו הפנימיות: מספר הפרמטרים גדל פי 2.4 לעומת הגרסה הקודמת. שינוי מבני חשוב נוסף הוא שהמודל אומן לחזות ישירות את הנתונים שיימדדו בתחנות מזג אוויר ספציפיות, ולא רק ממוצעים גיאוגרפיים - מה שמאפשר הן תחזיות גרנולריות יותר והן אימות מול נתוני שטח ממשיים.

    כניסה לממשק המשתמש היומיומי
    לראשונה, נתוני הליבה של WeatherNext 3 יוזנו ישירות למוצרי Google שנמצאים בשימוש יומיומי: תוצאות חיפוש, Google Maps ו-Gemini. המודל יהיה זמין גם לחוקרים ומפתחים דרך פלטפורמות הענן של Google.

    התחום אינו פרוז מתחרות. WindBorne, סטארט-אפ העושה שימוש בצי כדורי מזג אוויר, מציין כי המודל שלו WeatherMesh 6 מטמיע נתוני תצפית גולמיים מאז סוף 2025 - גם בלי להיעזר בפלטי הניתוח של מחשבי-העל הממשלתיים. Google מציינת כי WeatherNext 3 מציע רזולוציה גבוהה יותר ברמה גלובלית, אך שני המודלים עדיין נסמכים בחלקם על מאגרי נתונים לאומיים.

    השלכות מעבר לתחזית הצהריים
    השפעת המודלים הללו חורגת הרבה מעבר לנוחות הצרכנית. סוכנויות מזג אוויר ממשלתיות באירופה ובארצות הברית כבר משלבות מודלים מבוססי AI בתוצרים הרשמיים שלהן. במדינות מתפתחות, שבהן עלות מחשבי-על ורשתות חיישנים מנעה עד כה גישה לתחזיות מדויקות, מודלים כאלה עשויים לשפר תנובות חקלאיות ולהציל חיים במקרי אסון. בתחום האנרגיה המתחדשת, תחזיות רוח ועננות ברזולוציה גבוהה מגדילות את יכולת התכנון של פרויקטים סולאריים וטורבינות רוח - ועל כך הצביע גם ביל גייטס לאחרונה כאחד מהיישומים המשמעותיים ביותר של AI בעשור הקרוב.
    קרדיט: zirat ai


  • עדכונים בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    עדכוני ai כלליים

    הנחה של 95% על אימון: Meta משלמת למפתחים בנתוני השימוש שלהם

    תמחור כאסטרטגיה לאיסוף נתונים
    Meta הציגה מבנה תמחור שקוף וחריג בנוף הבינה המלאכותית: מי שישתמש במודל Muse Spark החדש שלה ויסכים לשתף את הפקודות ותפוקות המודל לצורכי אימון עתידי, ישלם שבריר מהמחיר הרגיל. מיליון טוקנים של קלט עולים בתנאים רגילים 1.25 דולר - ובתוכנית ה"תורם" רק 10 סנט. עבור טוקנים של פלט, המחיר יורד מ-4.25 דולר למיליון ל-20 סנט בלבד.

    מדובר בהנחה ממוצעת של כ-95%, שמבטאת שתי מציאויות בו-זמנית: עד כמה ה-API של Muse Spark יקר בתנאים מסחריים מלאים, ועד כמה Meta מייחסת ערך לנתוני שימוש אמיתיים ממפתחים.

    הרקע: קשיים בגיוס נתוני אימון
    החברה מתמודדת עם אתגר מובנה בתחום זה. ביוני השנה נחשף כי יוזמה פנימית לניטור השימוש של עובדים במחשביהם - שנועדה לאסוף נתוני אימון לסוכנים - הושהתה לאחר גל ביקורת פנימי, לפי דיווחי Reuters. מדיניות תמחור "התורמים" של Muse Spark היא למעשה מהלך חלופי: במקום לאסוף נתונים בשקט, Meta מציעה תמריץ כלכלי גלוי.

    דוגמה לצורך בנתונים כאלה מגיעה מעולם סוכני הקוד. מריו זכנר, המפתח מאחורי הסביבה בקוד פתוח Pi, ציין בראיון ל-TechCrunch כי הזינוק בביצועי סוכני הקוד בין אפריל לאוקטובר 2025 נבע במידה רבה מכך ש-Claude Code שמר כברירת מחדל את כל ה-sessions ועשה בהם שימוש לאימון מחוזק.

    החיכוך עם לקוחות ארגוניים
    האתגר שעומד בפני Meta זהה לזה שעומד בפני כל ספקי הבינה המלאכותית: ארגונים גדולים נוטים לשלם יותר כדי להגן על הנתונים שלהם. ארווינד נראיאנן, פרופסור למדעי המחשב מאוניברסיטת פרינסטון, הצביע על כך שחברות גדולות בוחרות לעתים קרובות בתוכניות ארגוניות יקרות יותר, גם כשתוכניות צרכניות מסובסדות כמו Claude Max או ChatGPT Pro זולות פי עשרה עד עשרים. ההבדל המרכזי הוא אחסון הנתונים ובקרת ה-IT הארגונית.

    מודל Meta מנסה להשיג את מה שחוזה סטנדרטי אינו מספק: הסכמה מפורשת ומתומחרת לשימוש בנתוני ייצור. מדריך התמחור של החברה מציין כי רמת התורמים "מורידה את חסם הכניסה לצורכי אבטיפוס, בדיקת אינטגרציות וניסויי קנה מידה" - לגיטימציה ישירה לאיסוף הנתונים.

    שוק שמתחרה על המחיר
    המהלך מגיע על רקע תחרות מחירים מחריפה בין מעבדות הבינה המלאכותית המובילות. Anthropic הורידה בימים האחרונים את עלויות עיבוד הטוקנים ה"שמורים" במודלים Fable ו-Mythos החדשים שלה. OpenAI ביצעה קיצוצי מחיר משמעותיים בסוף יולי עם השקת GPT-5 ומשפחתו.

    המודל Muse Spark מיועד ספציפית להפעלת סוכנים - גם לתכנות וגם לזרימות עבודה מקצועיות אחרות - ובכך מתמקד Meta בשוק שבו נתוני שימוש אמיתיים מורכבים קשים במיוחד להשגה: מרבית תהליכי העבודה המקצועיים אינם משאירים עקבות דיגיטליים מובנים שניתן לנתח ישירות.

    עבור מנהלים שמעריכים כעת פריסה של כלי סוכנים, ההחלטה עומדת בבירור: האם 95% הנחה שווה את הסיכון שנתוני הפקודות הפנימיות יהפכו לחומר אימון אצל Meta.
    קרדיט: zirat ai

  • התחברות

  • אין לך חשבון עדיין? הרשמה

  • התחברו או הירשמו כדי לחפש.
  • פוסט ראשון
    פוסט אחרון
0
  • דף הבית
  • חוקי הפורום
  • המדריך לשימוש בפורום
  • פוסטים אחרונים
  • לא נפתר
  • תגיות
  • משתמשים
  • חיפוש גוגל בפורום
  • צור קשר
  • פופולרי
  • קבוצות