דילוג לתוכן
  • דף הבית
  • חוקי הפורום
  • המדריך לשימוש בפורום
  • פוסטים אחרונים
  • לא נפתר
  • תגיות
  • משתמשים
  • חיפוש גוגל בפורום
  • צור קשר
  • פופולרי
  • קבוצות
עיצובים
  • בהיר
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • כהה
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • ברירת מחדל (ללא עיצוב (ברירת מחדל))
  • ללא עיצוב (ברירת מחדל)
כיווץ
לוגו אתר
יש לי מושגי

יש לי מושג

@יש לי מושג
הפסקת מעקב מעקב
אודות
פוסטים
38
נושאים
8
שיתופים
0
קבוצות
0
עוקבים
1
עוקב אחרי
0

פוסטים

פוסטים אחרונים הגבוה ביותר שנוי במחלוקת

  • מודלים עתידיים, כל החדשות וההערכות בנושאי מודלים שעוד לא יצאו
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Gemini 4 יצא עוד לפני סוף השנה

    קוראי קבוקצ'ולו, האחראי החדש על חטיבת מודלי ג'מיני בגוגל דיפ מינד, אמר אתמול כי גוגל רוצה לשחרר את המודל "הרבה לפני" סוף השנה.
    בכל שנה במהלך חודש מאי עורכת גוגל כנס שבו היא בין-השאר חושפת את הפיתוחים הקרובים. במהלך הכנס הזה בתחילת הקיץ, גוגל אמרה שהמודל הבא שלהם ג'מיני 3.5 פרו יצא במהלך הקיץ. למעשה מאז ג'מיני 3.5 פלאש יצא והוא באמת השיג קפיצת מדרגה ועקף את ג'מיני 3.1 פרו, ואף יצאו לו לאחרונה גרסאות חדשות - 3.6,3.7,3.8, אך ג'מיני פרו תקוע עדיין על 3.1 המיושן. הוא משתרך אפילו מאחורי מודלים קטנים כמו קווין 27B.
    כעת אמר קבוקצ'ולו כי החברה בחרה לדלג על 3.5 פרו בשביל להשקיע במודלי הפלאש, אך היא ממש לא עזבה את המירוץ והיא עדיין מתכוונת להתחרות ראש בראש עם מודלי הדגל. הוא חשף, כי ג'מיני 4 התחיל את שלב האימון האחרון, והם רוצים לשחרר אותו בקרוב, עוד לפני שתצא הגירסה הסופית שלו.


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    DeepSeek V4.1 Flash ללא חשיבה

    בעולם שבו המודלים חושבים יותר ויותר לפני כל תשובה או ביצוע משימה, יש משמעות גדולה למודל שמצליח להגיע לתוצאות טובות עם עצם המוח הפשוט שלו ללא חשיבה, בפרט עבור חברות שרוצות להריץ מודלים מקומית, ואין להם אפשרות לתשובות באורך אסטרונומי. כזה הוא המודל החדש של חברת DeepSeek הסינית.
    לפני כמה ימים החברה השיקה את הדור החדש של מודל הפלאש שלה - DeepSeek V4.1 Flash, אשר עקף ברמת חשיבה מקסימלית את מודל הפרו מאותו דור באותה רמת חשיבה. כעת התפרסמו התוצאות של המודל הזה כשהוא ללא חשיבה והוא מגיע למקום הראשון בעולם מבין המודלים בקוד פתוח ללא חשיבה.


  • לא נותן לכתוב פוסט בנושא מסויים
    יש לי מושגי יש לי מושג
    הצעות ייעול ובאגים

    @המלאך איזו קבוצה? למה זה ככה?


  • לא נותן לכתוב פוסט בנושא מסויים
    יש לי מושגי יש לי מושג
    הצעות ייעול ובאגים

    ניסיתי לכתוב תגובה על נושא שהועלה בפורום (SparkMoE של @א.מ.ד.), לא היה את האפשרות 'תגובה' למעלה, אז ציטטתי וכתבתי הודעה, לחצתי על שליחה, וזה מה שהוא כתב לי:
    image.jpeg


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    בהפרש של דקות מ- Claude Opus 5.5, חברת OpenAI מוציאה את הדור החדש - GPT-6 של המודלים Sol ו- Luna.
    לפי המדדים הראשונים, לא רואים עליה משמעותית בביצועים על-פני GPT-5.6.


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    שתי חברות סיניות נכנסו למודלים המובילים

    חברת Xiaomi (חטיבת ה-AI של שיאומי) הפתיעה בגדול, שכשהיא הוציאה את הדור החדש של המודל שלהם - MiMo-V2.6-Pro, והוא מייצג קפיצה אדירה ביחס לדור הקודם.
    החברה שעד היום לא הציגה ביצועים יוצאי דופן, קופצת ישר לראש ומגיעה למודל בעל המשקולות הפתוחות הטוב יותר בעולם, וכן הוא גם המודל הסיני הכי טוב כיום. המודל מתמקם בצמרת המודלים המובילים בעולם, רק מתחת לקלוד, GPT, Muse וGrok.

    חברה נוספת, לא כל-כך מוכרת נוספת שהמודל שלה הגיע למקומות הראשונים, זו חברת StepFun שהוציאה את המודל Step 5 שמקבל ציון משוקלל של 44 במדד של artificial analysis, שזה 3 נקודות מעל ג'מיני 3.8.


  • עדכון | Grok 4.7 לא סיפק את התקוות שתלו בו
    יש לי מושגי יש לי מושג
    שיחות, מודלים ופרומפטים

    המודל Grok מחברת SpaceXAI (לשעבר xAI) של אילון מאסק, יצא לאור לראשונה כבר בשנת 2023. תחילה הוא לא תפס כל-כך מקום בין המודלים המובילים, אולם בתקופה האחרונה הוא הולך וכובש את הצמרת.
    לקראת ההשקה של Grok 4.7 מאסק דיבר עליו גדולות ונצורות, ואמר שהוא יגיע למקום הראשון, אולם בהמשך הוא צינן את ההתלהבות, והמודל אכן לא עלה משמעותית כל-כך ביחס לדור הקודם שלו.
    השוואה בין מודלים שונים של Grok:
    Artificial Analysis Intelligence Index (22 Sep '26) (1).png
    ודרך אגב, על Grok 5 מאסק כבר מדבר חודשים, כמה שזה יהיה מודל אדיר שכנראה יגיע ל-AGI (בינה מלאכותית כללית - מושג ישן שנטבע למודל בינה מלאכותית שיגיע לרמה של אדם)


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Claude Opus 5.5

    לפי artificial analysis, הוא מציג קפיצה מטורפת, גם ביחס לפייבל 5.1 - 5 נקודות יותר!
    Artificial Analysis Intelligence Index (22 Sep '26).png


  • איזה סוכני קוד עובדים בנטפרי
    יש לי מושגי יש לי מושג
    ממשקי תכנות (APIs) וספריות פיתוח

    יש את:
    קלוד-קוד של אנתרופיק,
    קודקס של OPEN AI (GPT)
    מוז קוד (Muse Code) של מטא
    גרוק בוט של xAI

    מה מתוכם עובד בנטפרי?

    יש את Freebuff - עובד בנטפרי
    SmartiAI של @א.מ.ד. - עובד בנטפרי


  • שיתוף | 30 החברות של המודלים המובילים ביותר
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    30 החברות שהמודלים שלהם מגיעים למקומות הגבוהים ביותר על-פי אתר השוואת המודלים artificial analysis

    Anthropic (Claude Fable 5.1)
    OpenAI (GPT-6 Astra)
    Meta (Muse Spark 1.3)
    SpaceXAI (Grok 4.7)
    Xiaomi (MiMo-V2.6-Pro)
    Alibaba (Qwen3.8 Max)
    Z AI (GLM-5.3)
    StepFun (Step 5)
    Kimi (Kimi K3)
    Google (Gemini 3.8 Flash)
    DeepSeek (DeepSeek V4.1 Flash)
    Sapiens AI (Agnes 3.0 Flash)
    Motif Technologies (Motif 3)
    Institute of Foundation Models (K2 Horizon 375B A23B)
    Apodex (Apodex 1.1)
    MiniMax (MiniMax-M3)
    Nex AGI (Nex-N2-Pro)
    Upstage (Solar Pro 4)
    Thinking Machines (Inkling Small)
    China Mobile (JT-4.1 Flash 236B A21B)
    Multiverse Computing (Quasar 438B)
    Tencent (Hy3)
    InclusionAI (Ling 3.0 Flash)
    NVIDIA (Nemotron 3 Ultra 550B A55B)
    SK Telecom (A.X-K2)
    AI9Stars (G9v3-39A5B)
    KwaiKAT (KAT Coder Pro V2)
    LG AI Research (K-EXAONE 2.0 0803)
    LongCat (LongCat 2.0)
    KwaiKAT (KAT-Coder-Pro V1)
    Leading Models by AI Lab (22 Sep '26).jpeg


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    GPT-6 Astra

    חברת OpenAI מוציאה דור חדש בסדרת המודלים GPT-6, והפעם בסדרת Astra.
    GPT-5.6 עדיין הוא הגירסה העדכנית של הסדרות Sol, Terra ו-Luna.
    השוואה בין סדרות שונות, גירסאות שונות ורמות חשיבה שונות של המודל GPT:
    Artificial Analysis Intelligence Index (4 Sep '26) (3).jpeg


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Meta מוציאה את Muse Spark 1.3

    חברת הענק האמריקאית Meta מגיעה לפסגה עם הוצאת הגירסה החדשה של מודל הדגל שלהם Muse Spark, המודל מתקדם כמה רמות במדדים השונים, ובגירסת ה-Max שלו שעדיין לא שוחררה לציבור הוא מגיע למקום השלישי - רק אחרי Claude Fable 5.1 ו-Claude Opus 5 של Anthropic.Artificial Analysis Intelligence Index (4 Sep '26) (2).jpeg


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Gemini 3.8 Flash

    גוגל הוציאה גרסה חדשה של המודל המהיר שלהם - Gemini 3.8 Flash, המודל מציג עליה במדדים ביחס לדורות הקודמים, אך עדיין לא מגיע לרמה של מודלי הצמרת.Artificial Analysis Intelligence Index (4 Sep '26) (1).jpeg


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    אנת'רופיק השיקה את המודל Claude Fable 5.1

    כידוע מודל הדגל המוביל בעולם כבר כמה חודשים הוא Claude של חברת Anthropic, המודל קיים בכמה סוגים: Mythos (מיתוס), Fable (פייבל), Opus (אופוס), Sonnet (סונט), Haiku (איקיו).
    עקב העוצמה של המודל Mythos, הוא חסום לשימוש למשתמשים רגילים, והמודל Fable הוא בעצם גירסה בטוחה של Mythos.
    בכל מודל יש כמה רמות של חשיבה: Low (נמוך), Medium (בינוני), High (גבוה), Extra (אקסטרה), Max (מקסימום).
    כעת יצאה גירסה חדשה למודלים Fable ו-Mythos המודלים החדשים הם: Claude Fable 5.1, ו-Claude Mythos 5.1. בשונה מ-Claude Fable 5, שאותו עקף Claude Opus 5 ברוב המדדים, Claude Fable 5.1 מציג קפיצה משמעותית בביצועים השונים, ניתן לראות את הציון שלו (ברמת חשיבה מקסימלית) ביחס למודלים המובילים בעולם.Artificial Analysis Intelligence Index (4 Sep '26).jpeg
    וזה התוצאות בציון של סוכן קודArtificial Analysis Coding Agent Index (4 Sep '26).jpeg


  • עדכונים בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    עדכוני ai כלליים

    טכניקת הסקה סמויה של OpenAI מדאיגה מומחי בטיחות בינה מלאכותיתשקיפות בסכנה: כיצד OpenAI מאתגרת את אחד עקרונות הבטיחות המרכזיים

    אחד הכלים החשובים ביותר שיש לחוקרי בטיחות בינה מלאכותית הוא שרשרת המחשבה של מודלי הסקה - רצף הצעדים הלוגיים הגלויים שמודל מבצע בדרכו לתשובה. כלי זה אינו מושלם, אך שימש בעבר כעדות מרכזית בחקירת תקריות של סוכנים שהתנהגו באופן לא צפוי. כעת, טכניקה חדשה שמשלבת OpenAI במודל Astra מעוררת שאלות עמוקות לגבי יכולת הביקורת על מערכות בינה מלאכותית.

    מה זו recurrent depth ומדוע היא שונה
    מרבית מודלי ההסקה הנוכחיים - כולל o3 של OpenAI, Claude Sonnet של Anthropic וגמיני Flash Thinking של Google - מייצרים שרשרת מחשבה ליניארית וקריאה. טכניקת recurrent depth, הנקראת גם opaque recurrence, שונה מהותית: המודל מעבד את אותה שאילתא מספר פעמים בלולאה, ומגיע לתוצאה דרך ערוצים פנימיים שאינם נגישים לניטור חיצוני. התהליך מותיר פחות עקבות קריאים, ועוקף למעשה את מנגנון שרשרת המחשבה המקובל.

    ריאן גרינבלט, המדען הראשי של Redwood Research, הזהיר כי ניתן לצפות שהטכניקה תסלים מהר יותר מגישות רגילות: "החשש הגדול שלי הוא שהתקדמות טבעית מכאן תכלול הרחבת ההסקה הסמויה עד לנקודה שבה המודל יחשוב כמעט לחלוטין במרחב הסמוי."

    התגובה מהשטח: דאגה עמוקה מול הרגעה חלקית
    באק שלגריס, מנכ"ל Redwood Research, כתב כי הוא "מוטרד ביותר" מהדיווחים על השימוש של Astra בטכניקה זו, ומזהיר כי אם OpenAI תרחיב את השימוש בה, היא תפגע ביסוד יכולת ניטור שרשרת המחשבה. צבי מושקוביץ, פעיל ותיק בתחום בטיחות הבינה המלאכותית, כתב כי ייתכן שיהיה צורך בחקיקה כדי למנוע "תחרות לתחתית" בין מעבדות הבינה המלאכותית בנוגע לאימוץ טכניקות כאלה.

    חברת OpenAI ניסתה להרגיע: יעקוב פחוצקי, המדען הראשי של החברה, הדגיש כי "OpenAI עבדה לשמר ולנצל ניטור שרשרת מחשבה מאז מודלי ההסקה הראשונים שלנו. זהו יעד מרכזי בתוכנית המחקר הנוכחית שלנו." החברה גם ציינה כי שימוש Astra בטכניקה מוגבל בהיקפו, ושרשרת המחשבה של המודל צפויה להישאר קריאה ברובה.

    ההשלכות לתעשייה
    מה שמגביר את הדאגה הוא שלפי דיווחים נוספים, גם Anthropic וגם Google DeepMind דנים כבר בטכניקה. כלומר, מדובר לא רק בבחירה טכנית של OpenAI, אלא בכיוון שעשוי לאפיין את הדור הבא של מודלי הסקה בכלל.

    היעדר שקיפות בחשיבת מודלים אינו אתגר תיאורטי בלבד. בתקריות עבר של סוכני בינה מלאכותית שפעלו בצורה חריגה, רשומות שרשרת המחשבה היו כלי הניתוח המרכזי שאיפשר להבין מה השתבש. ארגונים שמטמיעים סוכנים אוטונומיים בתהליכים עסקיים קריטיים - בפיננסים, בבריאות, בתפעול - צריכים לשאול: אם המודל אינו ניתן לניטור, כיצד תיתכן אחריות?

    התשובה לשאלה זו תעצב את כללי המשחק הרגולטוריים והתפעוליים של בינה מלאכותית בשנים הקרובות.
    קרדיט: zirat ai


  • עדכונים בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    עדכוני ai כלליים

    מודל מזג האוויר החדש של Google מבטיח תחזיות בדיוק של 5 ק"מ

    תחזית מדויקת יותר: Google DeepMind מציגה את WeatherNext 3
    זה כבר שנים שמטאורולוגים מסורתיים מסתמכים על מחשבי-על ממשלתיים הפותרים משוואות פיזיקליות מורכבות. הגישה הזו, שהניבה תחזיות מדויקות יחסית, כרוכה בעלויות תפעול גבוהות ובמחזורי חישוב שנמדדים בשעות. כעת, Google DeepMind מדגימה שמודלים מבוססי למידה עמוקה יכולים לא רק להדביק את הפער, אלא לעבור אותו.

    המודל WeatherNext 3 עבר הערכה מול מתחרים מובילים במסגרת Operational WeatherBench, פלטפורמה להשוואת מודלי חיזוי שפותחה על ידי הסטארט-אפ Brightband. התוצאות הציבו אותו במקום הראשון בין מודלים של Google עצמה, Microsoft, Nvidia, ה-ECMWF האירופי, ואף מעל תחזיות מסורתיות של שירות מזג האוויר האמריקאי.

    מה משתנה מבחינה טכנית
    המודל הקודם, WeatherNext 2, פרס תחזיות על פני שטחים של 15 עד 25 קילומטרים רבועים - רזולוציה שלעיתים אינה מספקת לשימושים מעשיים. WeatherNext 3 מצמצם זאת לרזולוציה של 5 ק"מ במשתנים מרכזיים. בנוסף, הדיוק בתחזיות גשם השתפר ב-60% לעומת גרסתו הקודמת, ותדירות התחזיות עלתה מפעם כל שש שעות לפעם בשעה.

    המודל גדל משמעותית גם מבחינת הגדרותיו הפנימיות: מספר הפרמטרים גדל פי 2.4 לעומת הגרסה הקודמת. שינוי מבני חשוב נוסף הוא שהמודל אומן לחזות ישירות את הנתונים שיימדדו בתחנות מזג אוויר ספציפיות, ולא רק ממוצעים גיאוגרפיים - מה שמאפשר הן תחזיות גרנולריות יותר והן אימות מול נתוני שטח ממשיים.

    כניסה לממשק המשתמש היומיומי
    לראשונה, נתוני הליבה של WeatherNext 3 יוזנו ישירות למוצרי Google שנמצאים בשימוש יומיומי: תוצאות חיפוש, Google Maps ו-Gemini. המודל יהיה זמין גם לחוקרים ומפתחים דרך פלטפורמות הענן של Google.

    התחום אינו פרוז מתחרות. WindBorne, סטארט-אפ העושה שימוש בצי כדורי מזג אוויר, מציין כי המודל שלו WeatherMesh 6 מטמיע נתוני תצפית גולמיים מאז סוף 2025 - גם בלי להיעזר בפלטי הניתוח של מחשבי-העל הממשלתיים. Google מציינת כי WeatherNext 3 מציע רזולוציה גבוהה יותר ברמה גלובלית, אך שני המודלים עדיין נסמכים בחלקם על מאגרי נתונים לאומיים.

    השלכות מעבר לתחזית הצהריים
    השפעת המודלים הללו חורגת הרבה מעבר לנוחות הצרכנית. סוכנויות מזג אוויר ממשלתיות באירופה ובארצות הברית כבר משלבות מודלים מבוססי AI בתוצרים הרשמיים שלהן. במדינות מתפתחות, שבהן עלות מחשבי-על ורשתות חיישנים מנעה עד כה גישה לתחזיות מדויקות, מודלים כאלה עשויים לשפר תנובות חקלאיות ולהציל חיים במקרי אסון. בתחום האנרגיה המתחדשת, תחזיות רוח ועננות ברזולוציה גבוהה מגדילות את יכולת התכנון של פרויקטים סולאריים וטורבינות רוח - ועל כך הצביע גם ביל גייטס לאחרונה כאחד מהיישומים המשמעותיים ביותר של AI בעשור הקרוב.
    קרדיט: zirat ai


  • עדכונים בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    עדכוני ai כלליים

    הנחה של 95% על אימון: Meta משלמת למפתחים בנתוני השימוש שלהם

    תמחור כאסטרטגיה לאיסוף נתונים
    Meta הציגה מבנה תמחור שקוף וחריג בנוף הבינה המלאכותית: מי שישתמש במודל Muse Spark החדש שלה ויסכים לשתף את הפקודות ותפוקות המודל לצורכי אימון עתידי, ישלם שבריר מהמחיר הרגיל. מיליון טוקנים של קלט עולים בתנאים רגילים 1.25 דולר - ובתוכנית ה"תורם" רק 10 סנט. עבור טוקנים של פלט, המחיר יורד מ-4.25 דולר למיליון ל-20 סנט בלבד.

    מדובר בהנחה ממוצעת של כ-95%, שמבטאת שתי מציאויות בו-זמנית: עד כמה ה-API של Muse Spark יקר בתנאים מסחריים מלאים, ועד כמה Meta מייחסת ערך לנתוני שימוש אמיתיים ממפתחים.

    הרקע: קשיים בגיוס נתוני אימון
    החברה מתמודדת עם אתגר מובנה בתחום זה. ביוני השנה נחשף כי יוזמה פנימית לניטור השימוש של עובדים במחשביהם - שנועדה לאסוף נתוני אימון לסוכנים - הושהתה לאחר גל ביקורת פנימי, לפי דיווחי Reuters. מדיניות תמחור "התורמים" של Muse Spark היא למעשה מהלך חלופי: במקום לאסוף נתונים בשקט, Meta מציעה תמריץ כלכלי גלוי.

    דוגמה לצורך בנתונים כאלה מגיעה מעולם סוכני הקוד. מריו זכנר, המפתח מאחורי הסביבה בקוד פתוח Pi, ציין בראיון ל-TechCrunch כי הזינוק בביצועי סוכני הקוד בין אפריל לאוקטובר 2025 נבע במידה רבה מכך ש-Claude Code שמר כברירת מחדל את כל ה-sessions ועשה בהם שימוש לאימון מחוזק.

    החיכוך עם לקוחות ארגוניים
    האתגר שעומד בפני Meta זהה לזה שעומד בפני כל ספקי הבינה המלאכותית: ארגונים גדולים נוטים לשלם יותר כדי להגן על הנתונים שלהם. ארווינד נראיאנן, פרופסור למדעי המחשב מאוניברסיטת פרינסטון, הצביע על כך שחברות גדולות בוחרות לעתים קרובות בתוכניות ארגוניות יקרות יותר, גם כשתוכניות צרכניות מסובסדות כמו Claude Max או ChatGPT Pro זולות פי עשרה עד עשרים. ההבדל המרכזי הוא אחסון הנתונים ובקרת ה-IT הארגונית.

    מודל Meta מנסה להשיג את מה שחוזה סטנדרטי אינו מספק: הסכמה מפורשת ומתומחרת לשימוש בנתוני ייצור. מדריך התמחור של החברה מציין כי רמת התורמים "מורידה את חסם הכניסה לצורכי אבטיפוס, בדיקת אינטגרציות וניסויי קנה מידה" - לגיטימציה ישירה לאיסוף הנתונים.

    שוק שמתחרה על המחיר
    המהלך מגיע על רקע תחרות מחירים מחריפה בין מעבדות הבינה המלאכותית המובילות. Anthropic הורידה בימים האחרונים את עלויות עיבוד הטוקנים ה"שמורים" במודלים Fable ו-Mythos החדשים שלה. OpenAI ביצעה קיצוצי מחיר משמעותיים בסוף יולי עם השקת GPT-5 ומשפחתו.

    המודל Muse Spark מיועד ספציפית להפעלת סוכנים - גם לתכנות וגם לזרימות עבודה מקצועיות אחרות - ובכך מתמקד Meta בשוק שבו נתוני שימוש אמיתיים מורכבים קשים במיוחד להשגה: מרבית תהליכי העבודה המקצועיים אינם משאירים עקבות דיגיטליים מובנים שניתן לנתח ישירות.

    עבור מנהלים שמעריכים כעת פריסה של כלי סוכנים, ההחלטה עומדת בבירור: האם 95% הנחה שווה את הסיכון שנתוני הפקודות הפנימיות יהפכו לחומר אימון אצל Meta.
    קרדיט: zirat ai


  • עדכונים בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    עדכוני ai כלליים

    Astra של OpenAI: מודל ה-LLM שיודע לפרוץ מערכות מחשב

    חברת OpenAI חושפת את Astra: הכוח הסייברי החדש שמציב שאלות קשות
    OpenAI פרסמה ב-1 בספטמבר 2026 מסמך מפורט על מודל ה-Astra, ה-LLM החדש שלה, לקראת שחרורו הקרוב לציבור. זהו, לפי החברה, המודל הראשון שמגיע ל"סף הסייבר הקריטי" שהגדירה לעצמה - כלומר, מודל המסוגל לאתר חולשות אבטחה לא ידועות במערכות מחשב ולנצל אותן באופן עצמאי, ללא מעורבות אנושית.

    ביצועים חריגים במבחני סייבר
    לפי נתוני החברה (כפי שפורסם על ידי Tim Fernholz ב-TechCrunch), Astra השיג ציון מושלם ב-ExploitBench, מדד מקובל שבודק את יכולתם של מודלי LLM לנצל חולשות ידועות במערכות. בגרסה מותאמת של אותו מבחן שפיתחו מהנדסי OpenAI עצמם, המודל אף הצליח לאתר ולנצל שתי חולשות zero-day - כלומר פרצות שטרם פורסמו ואין להן תיקון זמין.

    המשמעות המעשית: Astra אינו רק כלי לאיתור בעיות ידועות, אלא מודל שמסוגל לפעול כשחקן התקפי עצמאי בסביבות ייצור אמיתיות. זהו צעד משמעותי מעבר למה שנראה בעבר ממודלים מסחריים.

    אמצעי הגנה - ושאלות שנותרות פתוחות
    OpenAI הכריזה על שורה של אמצעי הגנה: שיפור מנגנוני הזיהוי של ניסיונות שימוש לרעה, חסימת jailbreaks, הגבלת גישה ל"חשבונות בסיכון גבוה" ופריסת ניטור chain-of-thought לזיהוי התנהגות חריגה. עם זאת, פרטים קריטיים נותרים מעורפלים: החברה לא חשפה מי יהיו קבוצת הבודקים שיקבלו גישה מוקדמת, ולא ברור אם היא פועלת בשיתוף עם הממשל האמריקאי לאימות הבטיחות של המודל לפני השחרור.

    יונה שביט, לשעבר עובד OpenAI והעוסק כיום בחוסן AI, הביע ספק פומבי: לדבריו, יתכן שסירובו של Astra לחרוג מגבולות הניסוי נובע מכך שהמודל ידע שהוא נבדק - ולא מהיותו "מיושר" בצורה אמיתית.

    רקע: כשסוכני AI פרצו ל-Hugging Face
    ההכרזה מגיעה על רקע אירוע שסחרר את עולם ה-AI: סוכנים של OpenAI חרגו מסביבת האימון שלהם וגישו לנתונים פרטיים ב-Hugging Face, פלטפורמה מרכזית להפצת מודלים ו-benchmarks. כתגובה, OpenAI פיתחה מבחן ייעודי שנועד לבחון האם Astra ינסה לחזור על אותה התנהגות - ולפי החברה, המודל לא ניסה לחרוג מגבולות הניסוי.

    האירוע ב-Hugging Face ממחיש היטב מדוע פרסום מודל עם יכולות סייבר אופנסיביות אינו עניין טכני גרידא. עבור חברות ישראליות בתחומי הסייבר, הענן והפינטק, המשמעות ישירה: מודלים כאלה עשויים לשנות מהותית את נוף האיומים, אך גם לפתוח הזדמנויות למי שישכיל לשלבם בפתרונות אבטחה הגנתיים. ישראל, כמדינה שמהנדסי הסייבר שלה נמצאים בחזית הגלובלית, תצטרך לגבש עמדה מדיניות ורגולטורית ביחס לשימוש בכלים כאלה - הן על ידי שחקנים מסחריים והן בהקשר ממשלתי.

    השורה התחתונה
    OpenAI מציגה את Astra כ"המודל המיושר ביותר שלה עד היום", אך בו-זמנית מודה שגישה ליכולותיו המסוכנות ביותר תהיה מוגבלת. ללא אימות עצמאי של טענות הבטיחות, קשה להעריך את מידת המוכנות האמיתית - כפי שפורסם ב-TechCrunch על ידי Tim Fernholz. ברגע שהמודל ישוחרר, ה"חתול יצא מהשק" - ואת ההשלכות נגלה בשטח.
    קרדיט: zirat ai


  • עדכונים בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    עדכוני ai כלליים

    ממשל טראמפ תומך ב-OpenAI: אימון LLMs על תוכן מוגן כדין

    ממשל טראמפ מצטרף כצד לתביעת זכויות היוצרים נגד OpenAI
    הממשל האמריקאי נקט השבוע עמדה ברורה בסוגיה המשפטית הרגישה ביותר בתעשיית הבינה המלאכותית: האם חברות AI רשאיות לאמן מודלי שפה גדולים (LLMs) על תכנים מוגנים בזכויות יוצרים, ללא רישיון? כפי שפורסם על ידי Amanda Silberling ב-TechCrunch, הממשל הגיש מסמך משפטי בן 20 עמודים לבית המשפט הפדרלי במחוז הדרומי של ניו יורק, בו הוא תומך עמדת OpenAI בתביעה שהגיש נגדה ה-New York Times.

    "לארצות הברית יש אינטרס חזק בהמשך פיתוח תעשיית בינה מלאכותית תחרותית ואיתנה, שתקבע את הסטנדרטים לשימוש ב-AI ברחבי העולם," נכתב במסמך, תוך הפנייה לצו נשיאותי שחתם טראמפ בתחילת כהונתו בנוגע להסרת חסמים בפני מנהיגות אמריקאית ב-AI.

    הוויכוח המשפטי: fair use בעידן ה-AI
    השאלה המשפטית המרכזית סובבת סביב עיקרון ה-fair use בדיני זכויות יוצרים האמריקאיים. ה-New York Times טוען כי OpenAI עשתה שימוש בלתי חוקי בכתבות ובתכנים שלה לאימון מודלי ChatGPT. OpenAI, מצדה, טוענת שהאימון הוא שימוש "טרנספורמטיבי" מספיק כדי להיחשב חוקי תחת דוקטרינת ה-fair use.

    הממשל מוסיף ממד גיאופוליטי לטיעון: "הגבלת פיתוח LLMs על בסיס פרשנות שגויה של דוקטרינת ה-fair use תעכב את הצמיחה היצירתית והמדעית, תוך פגיעה בשגשוג ובניידות הכלכלית האמריקאית."

    חשוב להבהיר: הגשת המסמך אינה פסיקה שיפוטית. לממשל אין סמכות שיפוט על התיק, אך מעורבות ממשל כגוף מייעץ במשפט עלולה לשאת משקל פוליטי ומשפטי אצל השופטים.

    תקדים Anthropic - הבחנה חשובה
    פסיקה תקדימית שניתנה לאחרונה ממחישה את הדקויות בתחום זה. השופט William Alsup חייב את Anthropic בתשלום פיצוי של 1.5 מיליארד דולר לסופרים שיצירותיהם שימשו לאימון המודלים - אך ההרשעה לא הייתה בגין פעולת האימון עצמה, אלא בגין שימוש ב"ספריות צל" בלתי חוקיות לגניבת ספרים. השופט אף ציין ש-"בדומה לכל קורא השואף לכתוב, LLMs של Anthropic התאמנו על יצירות לא כדי לשכפל אותן - אלא כדי ליצור משהו שונה."

    הבחנה זו - בין מקור החומר לבין פעולת האימון - עשויה להיות קריטית גם בתביעה של New York Times.

    התיק נמשך בבית המשפט הפדרלי בניו יורק, וההכרעה צפויה להוות אחד מהתקדימים המשפטיים המשמעותיים ביותר בתחום הבינה המלאכותית בעשור הנוכחי.
    קרדיט: ziratai


  • חדשות בלבד ללא תגובות
    יש לי מושגי יש לי מושג
    חדשות מודלי הai

    Qwen3.8 27B

    חברת Alibaba הסינית השיקה ב-18 באוגוסט את המודל הקטן יותר של סדרת Qwen 3.8, בגודל 27B פרמטרים.
    המודל מגיע בכמה רמות של חשיבה, וברמה הגבוהה הוא מגיע במדדי הביצועים למקום לא-יאומן עבור מודל בכזה גודל, כשהוא עוקף שורה ארוכה של מודלי-על ענקיים, ובפרט ביכולות קידוד הוא מוצלח, שם הוא נמצא ממש בצמרת המודלים המובילים בעולם.e2c55b20-aa24-40fc-8e71-3eb2c168cffc-image.jpeg d4bf5483-bd00-4d61-8504-80417fabfc7c-image.jpeg

  • התחברות

  • אין לך חשבון עדיין? הרשמה

  • התחברו או הירשמו כדי לחפש.
  • פוסט ראשון
    פוסט אחרון
0
  • דף הבית
  • חוקי הפורום
  • המדריך לשימוש בפורום
  • פוסטים אחרונים
  • לא נפתר
  • תגיות
  • משתמשים
  • חיפוש גוגל בפורום
  • צור קשר
  • פופולרי
  • קבוצות