דילוג לתוכן

AI שמדבר כמו בשיחת טלפון.

פיתוח, תכנות ואינטגרציות
14 7 196 6
  • @mont-blanc א' יעבוד למשתמשי נטפרי ו המצלמה והשיתוף מסך זה קולט את המצלמה בלייב הוא מזהה אותך ולפי זה הוא אומר למשל אתה שואל אותו מה אני מחזיק ביד הוא אומר לך משקפיים. (אם אתה מחזיק ביד משקפיים) הוא אומר לך משקפיים סתם נתתי רק דוגמה טיפשית אתה יכול להגיד לו לתרגם דברים ועוד... ובשיתוף מסך יש לך בעיה הוא עוזר לך פשוט לפתור את הבעיה אם זה במחשב אם זה באתרים תרגום ועוד (סירי קיים רק ב אפל.) (גימיני צאט gpt לא בנטפרי)

    מדריכים חוקרי AI יוצרי AI
    כתב נערך לאחרונה על ידי
    #4

    @מאיר כתב:

    @mont-blanc א' יעבוד למשתמשי נטפרי ו המצלמה והשיתוף מסך זה קולט את המצלמה בלייב הוא מזהה אותך ולפי זה הוא אומר למשל אתה שואל אותו מה אני מחזיק ביד הוא אומר לך משקפיים. (אם אתה מחזיק ביד משקפיים) הוא אומר לך משקפיים סתם נתתי רק דוגמה טיפשית אתה יכול להגיד לו לתרגם דברים ועוד... ובשיתוף מסך יש לך בעיה הוא עוזר לך פשוט לפתור את הבעיה אם זה במחשב אם זה באתרים תרגום ועוד (סירי קיים רק ב אפל.) (גימיני צאט gpt לא בנטפרי)

    אם יש לך את הכלים והידע לפיתוח תנסה...
    מה שאתה מתאר זה פיתוח של AI מורכב מאד...

  • @מאיר כתב:

    @mont-blanc א' יעבוד למשתמשי נטפרי ו המצלמה והשיתוף מסך זה קולט את המצלמה בלייב הוא מזהה אותך ולפי זה הוא אומר למשל אתה שואל אותו מה אני מחזיק ביד הוא אומר לך משקפיים. (אם אתה מחזיק ביד משקפיים) הוא אומר לך משקפיים סתם נתתי רק דוגמה טיפשית אתה יכול להגיד לו לתרגם דברים ועוד... ובשיתוף מסך יש לך בעיה הוא עוזר לך פשוט לפתור את הבעיה אם זה במחשב אם זה באתרים תרגום ועוד (סירי קיים רק ב אפל.) (גימיני צאט gpt לא בנטפרי)

    אם יש לך את הכלים והידע לפיתוח תנסה...
    מה שאתה מתאר זה פיתוח של AI מורכב מאד...

    יוצרי AI
    כתב נערך לאחרונה על ידי
    #5

    @mont-blanc אני כבר יצרתי, הבעיה שאני רוצה להוסיף עוד דברים יש לך רעיונות?

  • יוצרי AI
    כתב נערך לאחרונה על ידי
    #6

    @antigravity מה אתה אומר?

  • @mont-blanc אני כבר יצרתי, הבעיה שאני רוצה להוסיף עוד דברים יש לך רעיונות?

    כתב נערך לאחרונה על ידי
    #7

    @מאיר כתב:

    אני כבר יצרתי, הבעיה שאני רוצה להוסיף עוד דברים יש לך רעיונות?

    אם תפרסם נוכל לתת עוד רעיונות...

  • אני רוצה לפתח AI שיוכל לדבר איתך בלייב ממש כמו בשיחת פלאפון איתך רק שיהיה לו מצלמה שיתוף מסך. האם כדאי לעשות את זה בכלל?????????? וא"כ תנו עוד רעיונות...

    מדריכים
    כתב נערך לאחרונה על ידי חובבן מקצועי
    #8

    @מאיר קצת מוזר (ומיותר) לפתח משהו שכבר קיים מלא זמן בגמיני (AI סטודיו, וגמיני עם דפדפן באנגלית) וGPT, אולי כדאי שתשקיע את הזמן בבקשות לנטפרי שיפתחו את זה..

  • כתב נערך לאחרונה על ידי בינארי חכם
    #9

    אין את זה עדיין בארץ אבל יש את ג'מיני אטווטר וגם במק אפשר לשתף איתו מסך אז זה לכאורה מיותר

    אבל זה מאוד חמוד ולא מופרך לי שאני אשתמש בזה אם זה יהיה מועיל..

  • אין את זה עדיין בארץ אבל יש את ג'מיני אטווטר וגם במק אפשר לשתף איתו מסך אז זה לכאורה מיותר

    אבל זה מאוד חמוד ולא מופרך לי שאני אשתמש בזה אם זה יהיה מועיל..

    חוקרי AI
    כתב נערך לאחרונה על ידי
    #10

    @בינארי-חכם יש את זה כן
    זה נמצא בכל אפליקציה וגם באתר של גימני
    כמובן שלא עובד בנטפרי

  • חוקרי AI יוצרי AI
    כתב נערך לאחרונה על ידי
    #11

    מתריע מראש שזה הולך להיות קשה עד בלתי אפשרי (בכל אופן אם אתה שואף שזה יהיה ממש כמו מצב Live של Gemini, או Voice של ChatGPT).

    ברמת הרעיון זה אמור להיות פשוט -
    מיקרופון להאזנה,
    עיבוד השמע לטקסט,
    שליחה למודל שמע של גוגל\OpenAI,
    עיבוד הטקסט,
    קבלת רצועת שמע קולית והשמעה.

    הקשיים המרכזיים שיש בזה, שעל חלקם אתה יכול להתגבר ועל חלקם לא:

    1. השהייה. ייקח למודל הרבה זמן להחזיר תשובת שמע לאחר כל שאלה. גוגל ו-OpenAI עבדו קשה שכל המהלך הזה יעבוד בשנייה - ויהיה לך קשה לחקות אותם...
    2. זיהוי סוף דיבור. קצת מסובך אבל אפשרי לאמן את המודל לזהות מתי סיימת לדבר בשביל לשלוח למודל הקולי את הטקסט ולהתחיל את התהליך.
    3. סינון רעשים. להתעלם מכל הרעשי רקע (ומקולות של אנשים אחרים - ) גוגל ו-OpenAI עבדו גם על זה מלא.
      (אם תשים לב, לפחות בגוגל, הוא מקשיב רק למי שהוא שמע את הקול שלו הראשון...)
    4. מניעת פידבק. היות והמיקרופון פעיל כל הזמן, צריך לוודא שהמיקרופון לא מאזין לדיבור של המודל עצמו.

    בקיצור יש לך הרבה עבודה, בכל אופן אם זה מגיע לכדי תוצר מוגמר כולנו נשמח שתעלה אותו כאן.

  • מתריע מראש שזה הולך להיות קשה עד בלתי אפשרי (בכל אופן אם אתה שואף שזה יהיה ממש כמו מצב Live של Gemini, או Voice של ChatGPT).

    ברמת הרעיון זה אמור להיות פשוט -
    מיקרופון להאזנה,
    עיבוד השמע לטקסט,
    שליחה למודל שמע של גוגל\OpenAI,
    עיבוד הטקסט,
    קבלת רצועת שמע קולית והשמעה.

    הקשיים המרכזיים שיש בזה, שעל חלקם אתה יכול להתגבר ועל חלקם לא:

    1. השהייה. ייקח למודל הרבה זמן להחזיר תשובת שמע לאחר כל שאלה. גוגל ו-OpenAI עבדו קשה שכל המהלך הזה יעבוד בשנייה - ויהיה לך קשה לחקות אותם...
    2. זיהוי סוף דיבור. קצת מסובך אבל אפשרי לאמן את המודל לזהות מתי סיימת לדבר בשביל לשלוח למודל הקולי את הטקסט ולהתחיל את התהליך.
    3. סינון רעשים. להתעלם מכל הרעשי רקע (ומקולות של אנשים אחרים - ) גוגל ו-OpenAI עבדו גם על זה מלא.
      (אם תשים לב, לפחות בגוגל, הוא מקשיב רק למי שהוא שמע את הקול שלו הראשון...)
    4. מניעת פידבק. היות והמיקרופון פעיל כל הזמן, צריך לוודא שהמיקרופון לא מאזין לדיבור של המודל עצמו.

    בקיצור יש לך הרבה עבודה, בכל אופן אם זה מגיע לכדי תוצר מוגמר כולנו נשמח שתעלה אותו כאן.

    חוקרי AI
    כתב נערך לאחרונה על ידי
    #12

    @בינה-יתרה
    מאיר לא דיבר על מודל דיבור אלא יותר על מודל של שיתוף מסך ומצלמה
    כי דיבור הרבה הרבה יותר קל

    @בינה-יתרה כתב:

    (אם תשים לב, לפחות בגוגל, הוא מקשיב רק למי שהוא שמע את הקול שלו הראשון...)

    וזה לגמרי לא נכון

  • אני רוצה לפתח AI שיוכל לדבר איתך בלייב ממש כמו בשיחת פלאפון איתך רק שיהיה לו מצלמה שיתוף מסך. האם כדאי לעשות את זה בכלל?????????? וא"כ תנו עוד רעיונות...

    מדריכים
    כתב נערך לאחרונה על ידי
    #13
  • כתב נערך לאחרונה על ידי
    #14

    @מוקד-המערכות

    אין שם שיתוף מסך וזה מאוד מוסיף


קרא עוד

  • 1 הצבעות
    3 פוסטים
    40 צפיות
    mont blancM
    עדכונים נוספים : ייבוא מאגר מ-GitHub: הפעולה ההפוכה להעלאה. מכיוון שהחיבור כבר קיים, קל להוסיף פרויקט חדש ממאגר קיים, ואחריו כפתור Pull לעדכון. כפתור עצירה לתשובת ה-AI: כרגע סגירת הפאנל לא עוצרת את הבקשה. כפתור "עצור" עם ביטול אמיתי של הבקשה יחסוך זמן וכסף. חיפוש בכל הפרויקט (Ctrl+Shift+F) והחלפה: חיפוש בין כל הקבצים, עם קפיצה ישירה לשורה. תצוגה מקדימה חכמה יותר: טעינה של כל קובץ CSV ו-JS לפי הקישורים ב-HTML, כולל תיקיות. זו המגבלה הכי בולטת היום. קונסולה בתצוגה המקדימה: חלונית שמציגה console.log ושגיאות JavaScript מתוך ה-iframe. שיפורי עריכה פורמט אוטומטי (Prettier) בלחיצה או בשמירה. קיצורי מקלדת: Ctrl+S לשמירה, Ctrl+P לפתיחה מהירה של קובץ, וכן פלטת פקודות. גרירה ושחרור בעץ הקבצים להזזת קבצים בין תיקיות, ולהעלאת קבצים מהמחשב. תצוגה צד-לצד של שני קבצים (למשל HTML ו-CSS). היסטוריית גרסאות מקומית: חזרה לגרסה קודמת של קובץ, בלי צורך ב-git. Undo להחלת שינוי של ה-AI, למקרה שהשינוי לא מוצא חן בעיניך. הרחבת ה-AI הצעת קוד תוך כדי הקלדה, כמו Copilot. פעולות על קוד מסומן: קליק ימני ובחירה של "הסבר", "תקן" או "שפר". היסטוריית צ'אט קבועה שנשמרת גם אחרי סגירת הלשונית, ושמוצגת מחדש אחרי רענון. בחירת קבצים לשליחה ל-AI, במקום כל הפרויקט, כדי לחסוך טוקנים. שיחת AI עם צילום מסך של התצוגה המקדימה, לתיקוני עיצוב. פרויקטים ושיתוף תבניות פרויקט מוכנות: דף נחיתה, אפליקציית React, משחק קטן. קישור לשיתוף של הפרויקט (דורש שרת או שימוש ב-GitHub Pages). פריסה בלחיצה ל-GitHub Pages אחרי ההעלאה, כדי שיהיה לך אתר חי. ייצוא וייבוא ZIP, כשהייבוא מחזיר פרויקט שנשמר קודם. גיבוי וייבוא של כל הפרויקטים לקובץ JSON, כי הכול נשמר רק בדפדפן ואפשר לאבד את זה בניקוי נתונים.
  • 14 הצבעות
    15 פוסטים
    206 צפיות
    א.מ.ד.א
    @המלאך כתב: @א.מ.ד. הדרך שבה המומחים עוברים, לא בדקתי את זה אבל nvme זה צורה אחרת של העברת נתונים.. כן, זה דיסק יותר מהיר, אבל כמו שכתבתי זה הסטנדרט כיום.
  • 9 הצבעות
    25 פוסטים
    423 צפיות
    א.מ.ד.א
    @יודע-ומייבין כתב: @א.מ.ד. אמרת שהוא יהיה כנראה עם דפדפן פנימי ועם שליטה מלאה על המחשב נו?