דילוג לתוכן
  • חוקי הפורום
  • פופולרי
  • לא נפתר
  • משתמשים
  • חיפוש גוגל בפורום
  • צור קשר
עיצובים
  • בהיר
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • כהה
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • ברירת מחדל (ללא עיצוב (ברירת מחדל))
  • ללא עיצוב (ברירת מחדל)
כיווץ
מתמחים טופ
  1. דף הבית
  2. קטגוריות בהרצה
  3. תכנות
  4. בינה מלאכותית - AI
  5. עזרה הדדית - בינה מלאכותית
  6. SparkMoE - מערכת להרצת מודלי AI גדולים ועוצמתיים באופן מקומי על חומרה חלשה, עדכון - גרסה V0.3.0!

SparkMoE - מערכת להרצת מודלי AI גדולים ועוצמתיים באופן מקומי על חומרה חלשה, עדכון - גרסה V0.3.0!

מתוזמן נעוץ נעול הועבר עזרה הדדית - בינה מלאכותית
132 פוסטים 22 כותבים 2.0k צפיות 28 עוקבים
  • מהישן לחדש
  • מהחדש לישן
  • הכי הרבה הצבעות
תגובה
  • תגובה כנושא
התחברו כדי לפרסם תגובה
נושא זה נמחק. רק משתמשים עם הרשאות מתאימות יוכלו לצפות בו.
  • חובבן מקצועיח חובבן מקצועי

    @רפי-סאם אתה בטוח? הוא ממש טיפש..
    עדיף לעבוד על gemma מסדרה 4. (יש לך את gemma 4 E2b שהוא שוקל 3.5 GB)

    ר מנותק
    ר מנותק
    רפי סאם
    כתב נערך לאחרונה על ידי רפי סאם
    #115

    @חובבן-מקצועי המהירות מפצה...
    עריכה כתבתי לפני שהו כתב על גמא 4

    המלאךה חובבן מקצועיח 2 תגובות תגובה אחרונה
    0
    • ר רפי סאם

      @חובבן-מקצועי המהירות מפצה...
      עריכה כתבתי לפני שהו כתב על גמא 4

      המלאךה מנותק
      המלאךה מנותק
      המלאך
      כתב נערך לאחרונה על ידי
      #116

      @רפי-סאם מה פתאום?
      זה אותו כימות.
      ההבדל מיזערי.

      האתר שלי: https://amlaach.github.io/personal-site/

      תגובה 1 תגובה אחרונה
      0
      • ר רפי סאם

        @חובבן-מקצועי המהירות מפצה...
        עריכה כתבתי לפני שהו כתב על גמא 4

        חובבן מקצועיח מנותק
        חובבן מקצועיח מנותק
        חובבן מקצועי
        כתב נערך לאחרונה על ידי
        #117

        @רפי-סאם כתב:

        @חובבן-מקצועי המהירות מפצה...

        לדעתי היא לא מפצה על כלום (לפי מה שזכור לי על המודל ההוא כשהרצתי אותו בעבר), gemma 3 בכלל - הוא מהסוג הישן - בלי חשיבה, ועוד כזה קצת פרמטרים..

        תגובה 1 תגובה אחרונה
        🙄
        0
        • ר רפי סאם

          @א.מ.ד. אני ממליץ על המודול gemma-3-1b-it-Q8_0.gguf - 1020 MiB
          הוא מאוד מהיר ונוח על מחשב של 16 ראם

          חובבן מקצועיח מנותק
          חובבן מקצועיח מנותק
          חובבן מקצועי
          כתב נערך לאחרונה על ידי חובבן מקצועי
          #118

          @רפי-סאם הנה צילו"מ משאלה פשוטה, שאולי טיפה תראה את ההבדל. (גילוי נאות, המודל gemma 3 1b שיש פה הוא בכימות 4Q - אבל לא נראה לי שזה באמת משנה. בעז"ה בהמשך אנסה על 8Q ונראה מה יהיה ההבדל..
          עריכה: בדקתי 8Q אין הבדל כלשהו, גם כן עונה תשובה שגויה.)

          gemma 4 E2b Q5
          382e24d7-5510-49ce-8d4a-bcbef7d9126f-image.jpeg

          gemma 3 1b Q4
          37a75a48-99cf-467b-a9b0-076643a6a6dc-image.jpeg

          המלאךה א.מ.ד.א 2 תגובות תגובה אחרונה
          😂
          1
          • חובבן מקצועיח חובבן מקצועי

            @רפי-סאם הנה צילו"מ משאלה פשוטה, שאולי טיפה תראה את ההבדל. (גילוי נאות, המודל gemma 3 1b שיש פה הוא בכימות 4Q - אבל לא נראה לי שזה באמת משנה. בעז"ה בהמשך אנסה על 8Q ונראה מה יהיה ההבדל..
            עריכה: בדקתי 8Q אין הבדל כלשהו, גם כן עונה תשובה שגויה.)

            gemma 4 E2b Q5
            382e24d7-5510-49ce-8d4a-bcbef7d9126f-image.jpeg

            gemma 3 1b Q4
            37a75a48-99cf-467b-a9b0-076643a6a6dc-image.jpeg

            המלאךה מנותק
            המלאךה מנותק
            המלאך
            כתב נערך לאחרונה על ידי המלאך
            #119

            @חובבן-מקצועי ברור שהכימות משנה.
            בשאלות כאלה שדורשות סוג של ירידה לפרטים הקטנים, הדבר שכימות הכי נכשל בו..

            האתר שלי: https://amlaach.github.io/personal-site/

            א.מ.ד.א תגובה 1 תגובה אחרונה
            1
            • המלאךה המלאך

              @חובבן-מקצועי ברור שהכימות משנה.
              בשאלות כאלה שדורשות סוג של ירידה לפרטים הקטנים, הדבר שכימות הכי נכשל בו..

              א.מ.ד.א מנותק
              א.מ.ד.א מנותק
              א.מ.ד.
              מדריכים
              כתב נערך לאחרונה על ידי
              #120

              @המלאך כתב:

              @חובבן-מקצועי ברור שהכימות משנה.
              בשאלות כאלה שדורשות סוג של ירידה לפרטים הקטנים, הדבר שכימות הכי נכשל בו..

              אבל הפער בין Q8 ל-Q4 לא משמעותי.

              מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

              המלאךה תגובה 1 תגובה אחרונה
              0
              • א.מ.ד.א א.מ.ד.

                @המלאך כתב:

                @חובבן-מקצועי ברור שהכימות משנה.
                בשאלות כאלה שדורשות סוג של ירידה לפרטים הקטנים, הדבר שכימות הכי נכשל בו..

                אבל הפער בין Q8 ל-Q4 לא משמעותי.

                המלאךה מנותק
                המלאךה מנותק
                המלאך
                כתב נערך לאחרונה על ידי
                #121

                @א.מ.ד. ברור שסוג המודל משנה.
                אבל ברור שבדבר שמצריך ירידה לפרטים הקטנים ההבדל ישנה.

                האתר שלי: https://amlaach.github.io/personal-site/

                תגובה 1 תגובה אחרונה
                0
                • חובבן מקצועיח חובבן מקצועי

                  @רפי-סאם הנה צילו"מ משאלה פשוטה, שאולי טיפה תראה את ההבדל. (גילוי נאות, המודל gemma 3 1b שיש פה הוא בכימות 4Q - אבל לא נראה לי שזה באמת משנה. בעז"ה בהמשך אנסה על 8Q ונראה מה יהיה ההבדל..
                  עריכה: בדקתי 8Q אין הבדל כלשהו, גם כן עונה תשובה שגויה.)

                  gemma 4 E2b Q5
                  382e24d7-5510-49ce-8d4a-bcbef7d9126f-image.jpeg

                  gemma 3 1b Q4
                  37a75a48-99cf-467b-a9b0-076643a6a6dc-image.jpeg

                  א.מ.ד.א מנותק
                  א.מ.ד.א מנותק
                  א.מ.ד.
                  מדריכים
                  כתב נערך לאחרונה על ידי
                  #122

                  @חובבן-מקצועי אגב, יש שאלה שאני אוהב לשאול מודלים קטנים, ולראות את תגובתם - לסאלי יש 3 אחים. לכל אחד מאחיה יש 2 אחיות. כמה אחיות יש לסאלי?
                  התשובה היא כמובן 1, אבל רוב המודלים הקטנים עונים 6, 5 או 2...

                  מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

                  חובבן מקצועיח CSS 0C 2 תגובות תגובה אחרונה
                  0
                  • א.מ.ד.א א.מ.ד.

                    @חובבן-מקצועי אגב, יש שאלה שאני אוהב לשאול מודלים קטנים, ולראות את תגובתם - לסאלי יש 3 אחים. לכל אחד מאחיה יש 2 אחיות. כמה אחיות יש לסאלי?
                    התשובה היא כמובן 1, אבל רוב המודלים הקטנים עונים 6, 5 או 2...

                    חובבן מקצועיח מנותק
                    חובבן מקצועיח מנותק
                    חובבן מקצועי
                    כתב נערך לאחרונה על ידי חובבן מקצועי
                    #123

                    @א.מ.ד. כתב:

                    התשובה היא כמובן 1, אבל רוב המודלים הקטנים עונים 6, 5 או 2...

                    gemma 4 E2b ענה תשובה נכונה.. (שאגב, מוזר שהוא לא עונה נכונה על השאלה של 'לאמא של דני יש שלושה ילדים, אברהם יצחק ו? (הוא עונה 'אנא ספק לי עוד מידע') ולשאלה הזו E4B עונה מצויין.)

                    תגובה 1 תגובה אחרונה
                    1
                    • א.מ.ד.א א.מ.ד.

                      @חובבן-מקצועי אגב, יש שאלה שאני אוהב לשאול מודלים קטנים, ולראות את תגובתם - לסאלי יש 3 אחים. לכל אחד מאחיה יש 2 אחיות. כמה אחיות יש לסאלי?
                      התשובה היא כמובן 1, אבל רוב המודלים הקטנים עונים 6, 5 או 2...

                      CSS 0C מחובר
                      CSS 0C מחובר
                      CSS 0
                      מדריכים
                      כתב נערך לאחרונה על ידי
                      #124

                      @א.מ.ד. לי gemma4E4B אומר 2 (כי הוא טוען שסאלי זה שם שבן ולא מוכן להסכים איתי...) ו E2B בכלל נע בין 6\5\4\3\2

                      https://iosii123212-hub.github.io/ani/

                      חובבן מקצועיח תגובה 1 תגובה אחרונה
                      😂
                      0
                      • CSS 0C CSS 0

                        @א.מ.ד. לי gemma4E4B אומר 2 (כי הוא טוען שסאלי זה שם שבן ולא מוכן להסכים איתי...) ו E2B בכלל נע בין 6\5\4\3\2

                        חובבן מקצועיח מנותק
                        חובבן מקצועיח מנותק
                        חובבן מקצועי
                        כתב נערך לאחרונה על ידי
                        #125

                        @CSS-0 תבדוק, אולי במקרה כיבית את מצב חשיבה? זה משפיע על התשובה.

                        CSS 0C תגובה 1 תגובה אחרונה
                        0
                        • חובבן מקצועיח חובבן מקצועי

                          @CSS-0 תבדוק, אולי במקרה כיבית את מצב חשיבה? זה משפיע על התשובה.

                          CSS 0C מחובר
                          CSS 0C מחובר
                          CSS 0
                          מדריכים
                          כתב נערך לאחרונה על ידי
                          #126

                          @חובבן-מקצועי אני אף פעם לא מפעיל אני אוהב לבחון אותם רק כשהחשיבה כבויה אחרי ששיניתי את החידה הוא סוף סוף ענה ששאלתי במקום "סאלי" כתבתי לו "רבקה" ... ובקיצור על החידה של הלאמא של דני.. וכ"ו הוא ענה יפה נכון.

                          https://iosii123212-hub.github.io/ani/

                          תגובה 1 תגובה אחרונה
                          0
                          • א.מ.ד.א א.מ.ד.

                            @פתרון-AI אין לך צורך בתוכנה שלי בשביל מודלים בינוניים. אתה יכול להריץ אותם כרגיל עם LM Studio, במהירות מטורפת.
                            אני מדבר על מודלי MoE עד 40B, או מודלים צפופים עד כ-14B. אבל גם מודלים צפופים של 30B יעבדו מהר יחסית ע"י העברת חלק מהשכבות ל-GPU. אז תנסה את סדרות Gemma 4 ו-Qwen 3.6.
                            אם בכל זאת תרצה להריץ מודלי MoE גדולים יותר כמו Qwen 3.5 122B A10B, תוכל להשתמש בתוכנה שלי. היא אמורה לתמוך ב-GPU, אבל אני צריך לבדוק את זה, כי מלכתחילה לא התעסקתי בחומרה חזקה. בגרסה הבאה זה יובא בחשבון.
                            @אריאלל זה עונה גם לשאלתך.

                            א מנותק
                            א מנותק
                            אריאלל
                            כתב נערך לאחרונה על ידי אריאלל
                            #127

                            @א.מ.ד. בדקתי את זה עכשיו, זה אמנם עובד באופן מצוין כלפי הטעינה החלקית לזיכרון, אבל ל-GPU זה לא טוען בכלל.

                            זה חשוב גם למחשבים כאלה, כי לי למשל יש VRAM של 6 GB שזה קצת באופן יחסי והשאר עובר ל-RAM מה שמאט את הביצועים משמעותית ומייתר למעשה את הכרטיס גרפי.

                            אם תוכל להתאים את התוכנה גם ל-GPU זה יעזור מאד.
                            תודה על ההשקעה👌
                            4eaa2528-98c1-4631-92f2-dff153e34562-image.jpeg

                            ה המלאךה 2 תגובות תגובה אחרונה
                            1
                            • א אריאלל

                              @א.מ.ד. בדקתי את זה עכשיו, זה אמנם עובד באופן מצוין כלפי הטעינה החלקית לזיכרון, אבל ל-GPU זה לא טוען בכלל.

                              זה חשוב גם למחשבים כאלה, כי לי למשל יש VRAM של 6 GB שזה קצת באופן יחסי והשאר עובר ל-RAM מה שמאט את הביצועים משמעותית ומייתר למעשה את הכרטיס גרפי.

                              אם תוכל להתאים את התוכנה גם ל-GPU זה יעזור מאד.
                              תודה על ההשקעה👌
                              4eaa2528-98c1-4631-92f2-dff153e34562-image.jpeg

                              ה מנותק
                              ה מנותק
                              החכם השלם
                              כתב נערך לאחרונה על ידי
                              #128

                              @אריאלל סתם ככה יש לך מעבד NPU שמותאם יותר לבינה מלאכותית, אין לי מושג אם כיום יש כלים שמנצלים אותו טוב יור מהתוצאות שהכרטיס הגרפי יביא, שווה לבדוק.

                              א תגובה 1 תגובה אחרונה
                              0
                              • ה החכם השלם

                                @אריאלל סתם ככה יש לך מעבד NPU שמותאם יותר לבינה מלאכותית, אין לי מושג אם כיום יש כלים שמנצלים אותו טוב יור מהתוצאות שהכרטיס הגרפי יביא, שווה לבדוק.

                                א מנותק
                                א מנותק
                                אריאלל
                                כתב נערך לאחרונה על ידי
                                #129

                                @החכם-השלם זה NPU שיצא לפני עידן ה AI הביתי.
                                יש לו אולי 7 TOPS, והוא נועד בעיקר לתכונות במצלמה כמו מעקב פנים וטשטוש.

                                תגובה 1 תגובה אחרונה
                                0
                                • א אריאלל

                                  @א.מ.ד. בדקתי את זה עכשיו, זה אמנם עובד באופן מצוין כלפי הטעינה החלקית לזיכרון, אבל ל-GPU זה לא טוען בכלל.

                                  זה חשוב גם למחשבים כאלה, כי לי למשל יש VRAM של 6 GB שזה קצת באופן יחסי והשאר עובר ל-RAM מה שמאט את הביצועים משמעותית ומייתר למעשה את הכרטיס גרפי.

                                  אם תוכל להתאים את התוכנה גם ל-GPU זה יעזור מאד.
                                  תודה על ההשקעה👌
                                  4eaa2528-98c1-4631-92f2-dff153e34562-image.jpeg

                                  המלאךה מנותק
                                  המלאךה מנותק
                                  המלאך
                                  כתב נערך לאחרונה על ידי
                                  #130

                                  @אריאלל אולי זה יעזור לך.
                                  https://github.com/lyogavin/airllm

                                  האתר שלי: https://amlaach.github.io/personal-site/

                                  cfopuserC תגובה 1 תגובה אחרונה
                                  2
                                  • המלאךה המלאך

                                    @אריאלל אולי זה יעזור לך.
                                    https://github.com/lyogavin/airllm

                                    cfopuserC מנותק
                                    cfopuserC מנותק
                                    cfopuser
                                    כתב נערך לאחרונה על ידי
                                    #131

                                    @המלאך מה המהירות של זה?

                                    Kimi K3 (2.8T) — the largest open-source model released to date — on under 4GB
                                    
                                    המלאךה תגובה 1 תגובה אחרונה
                                    1
                                    • cfopuserC cfopuser

                                      @המלאך מה המהירות של זה?

                                      Kimi K3 (2.8T) — the largest open-source model released to date — on under 4GB
                                      
                                      המלאךה מנותק
                                      המלאךה מנותק
                                      המלאך
                                      כתב נערך לאחרונה על ידי
                                      #132

                                      @cfopuser איטי מאוד,
                                      אני מניח.

                                      האתר שלי: https://amlaach.github.io/personal-site/

                                      תגובה 1 תגובה אחרונה
                                      2

                                      שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.

                                      נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.

                                      בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗

                                      הרשמה התחברות

                                      • התחברות

                                      • אין לך חשבון עדיין? הרשמה

                                      • התחברו או הירשמו כדי לחפש.
                                      • פוסט ראשון
                                        פוסט אחרון
                                      0
                                      • חוקי הפורום
                                      • פופולרי
                                      • לא נפתר
                                      • משתמשים
                                      • חיפוש גוגל בפורום
                                      • צור קשר