דילוג לתוכן
  • חוקי הפורום
  • פופולרי
  • לא נפתר
  • משתמשים
  • חיפוש גוגל בפורום
  • צור קשר
עיצובים
  • בהיר
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • כהה
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • ברירת מחדל (ללא עיצוב (ברירת מחדל))
  • ללא עיצוב (ברירת מחדל)
כיווץ
מתמחים טופ
  1. דף הבית
  2. קטגוריות בהרצה
  3. תכנות
  4. בינה מלאכותית - AI
  5. עזרה הדדית - בינה מלאכותית
  6. SparkMoE - מערכת להרצת מודלי AI גדולים ועוצמתיים באופן מקומי על חומרה חלשה, עדכון - גרסה V0.3.0!

SparkMoE - מערכת להרצת מודלי AI גדולים ועוצמתיים באופן מקומי על חומרה חלשה, עדכון - גרסה V0.3.0!

מתוזמן נעוץ נעול הועבר עזרה הדדית - בינה מלאכותית
132 פוסטים 22 כותבים 2.0k צפיות 28 עוקבים
  • מהישן לחדש
  • מהחדש לישן
  • הכי הרבה הצבעות
תגובה
  • תגובה כנושא
התחברו כדי לפרסם תגובה
נושא זה נמחק. רק משתמשים עם הרשאות מתאימות יוכלו לצפות בו.
  • ר רפי סאם

    @א.מ.ד. אני ממליץ על המודול gemma-3-1b-it-Q8_0.gguf - 1020 MiB
    הוא מאוד מהיר ונוח על מחשב של 16 ראם

    חובבן מקצועיח מנותק
    חובבן מקצועיח מנותק
    חובבן מקצועי
    כתב נערך לאחרונה על ידי חובבן מקצועי
    #114

    @רפי-סאם אתה בטוח? הוא ממש טיפש..
    עדיף לעבוד על gemma מסדרה 4. (יש לך את gemma 4 E2b שהוא שוקל 3.5 GB)

    ר תגובה 1 תגובה אחרונה
    0
    • חובבן מקצועיח חובבן מקצועי

      @רפי-סאם אתה בטוח? הוא ממש טיפש..
      עדיף לעבוד על gemma מסדרה 4. (יש לך את gemma 4 E2b שהוא שוקל 3.5 GB)

      ר מנותק
      ר מנותק
      רפי סאם
      כתב נערך לאחרונה על ידי רפי סאם
      #115

      @חובבן-מקצועי המהירות מפצה...
      עריכה כתבתי לפני שהו כתב על גמא 4

      המלאךה חובבן מקצועיח 2 תגובות תגובה אחרונה
      0
      • ר רפי סאם

        @חובבן-מקצועי המהירות מפצה...
        עריכה כתבתי לפני שהו כתב על גמא 4

        המלאךה מנותק
        המלאךה מנותק
        המלאך
        כתב נערך לאחרונה על ידי
        #116

        @רפי-סאם מה פתאום?
        זה אותו כימות.
        ההבדל מיזערי.

        האתר שלי: https://amlaach.github.io/personal-site/

        תגובה 1 תגובה אחרונה
        0
        • ר רפי סאם

          @חובבן-מקצועי המהירות מפצה...
          עריכה כתבתי לפני שהו כתב על גמא 4

          חובבן מקצועיח מנותק
          חובבן מקצועיח מנותק
          חובבן מקצועי
          כתב נערך לאחרונה על ידי
          #117

          @רפי-סאם כתב:

          @חובבן-מקצועי המהירות מפצה...

          לדעתי היא לא מפצה על כלום (לפי מה שזכור לי על המודל ההוא כשהרצתי אותו בעבר), gemma 3 בכלל - הוא מהסוג הישן - בלי חשיבה, ועוד כזה קצת פרמטרים..

          תגובה 1 תגובה אחרונה
          🙄
          0
          • ר רפי סאם

            @א.מ.ד. אני ממליץ על המודול gemma-3-1b-it-Q8_0.gguf - 1020 MiB
            הוא מאוד מהיר ונוח על מחשב של 16 ראם

            חובבן מקצועיח מנותק
            חובבן מקצועיח מנותק
            חובבן מקצועי
            כתב נערך לאחרונה על ידי חובבן מקצועי
            #118

            @רפי-סאם הנה צילו"מ משאלה פשוטה, שאולי טיפה תראה את ההבדל. (גילוי נאות, המודל gemma 3 1b שיש פה הוא בכימות 4Q - אבל לא נראה לי שזה באמת משנה. בעז"ה בהמשך אנסה על 8Q ונראה מה יהיה ההבדל..
            עריכה: בדקתי 8Q אין הבדל כלשהו, גם כן עונה תשובה שגויה.)

            gemma 4 E2b Q5
            382e24d7-5510-49ce-8d4a-bcbef7d9126f-image.jpeg

            gemma 3 1b Q4
            37a75a48-99cf-467b-a9b0-076643a6a6dc-image.jpeg

            המלאךה א.מ.ד.א 2 תגובות תגובה אחרונה
            😂
            1
            • חובבן מקצועיח חובבן מקצועי

              @רפי-סאם הנה צילו"מ משאלה פשוטה, שאולי טיפה תראה את ההבדל. (גילוי נאות, המודל gemma 3 1b שיש פה הוא בכימות 4Q - אבל לא נראה לי שזה באמת משנה. בעז"ה בהמשך אנסה על 8Q ונראה מה יהיה ההבדל..
              עריכה: בדקתי 8Q אין הבדל כלשהו, גם כן עונה תשובה שגויה.)

              gemma 4 E2b Q5
              382e24d7-5510-49ce-8d4a-bcbef7d9126f-image.jpeg

              gemma 3 1b Q4
              37a75a48-99cf-467b-a9b0-076643a6a6dc-image.jpeg

              המלאךה מנותק
              המלאךה מנותק
              המלאך
              כתב נערך לאחרונה על ידי המלאך
              #119

              @חובבן-מקצועי ברור שהכימות משנה.
              בשאלות כאלה שדורשות סוג של ירידה לפרטים הקטנים, הדבר שכימות הכי נכשל בו..

              האתר שלי: https://amlaach.github.io/personal-site/

              א.מ.ד.א תגובה 1 תגובה אחרונה
              1
              • המלאךה המלאך

                @חובבן-מקצועי ברור שהכימות משנה.
                בשאלות כאלה שדורשות סוג של ירידה לפרטים הקטנים, הדבר שכימות הכי נכשל בו..

                א.מ.ד.א מנותק
                א.מ.ד.א מנותק
                א.מ.ד.
                מדריכים
                כתב נערך לאחרונה על ידי
                #120

                @המלאך כתב:

                @חובבן-מקצועי ברור שהכימות משנה.
                בשאלות כאלה שדורשות סוג של ירידה לפרטים הקטנים, הדבר שכימות הכי נכשל בו..

                אבל הפער בין Q8 ל-Q4 לא משמעותי.

                מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

                המלאךה תגובה 1 תגובה אחרונה
                0
                • א.מ.ד.א א.מ.ד.

                  @המלאך כתב:

                  @חובבן-מקצועי ברור שהכימות משנה.
                  בשאלות כאלה שדורשות סוג של ירידה לפרטים הקטנים, הדבר שכימות הכי נכשל בו..

                  אבל הפער בין Q8 ל-Q4 לא משמעותי.

                  המלאךה מנותק
                  המלאךה מנותק
                  המלאך
                  כתב נערך לאחרונה על ידי
                  #121

                  @א.מ.ד. ברור שסוג המודל משנה.
                  אבל ברור שבדבר שמצריך ירידה לפרטים הקטנים ההבדל ישנה.

                  האתר שלי: https://amlaach.github.io/personal-site/

                  תגובה 1 תגובה אחרונה
                  0
                  • חובבן מקצועיח חובבן מקצועי

                    @רפי-סאם הנה צילו"מ משאלה פשוטה, שאולי טיפה תראה את ההבדל. (גילוי נאות, המודל gemma 3 1b שיש פה הוא בכימות 4Q - אבל לא נראה לי שזה באמת משנה. בעז"ה בהמשך אנסה על 8Q ונראה מה יהיה ההבדל..
                    עריכה: בדקתי 8Q אין הבדל כלשהו, גם כן עונה תשובה שגויה.)

                    gemma 4 E2b Q5
                    382e24d7-5510-49ce-8d4a-bcbef7d9126f-image.jpeg

                    gemma 3 1b Q4
                    37a75a48-99cf-467b-a9b0-076643a6a6dc-image.jpeg

                    א.מ.ד.א מנותק
                    א.מ.ד.א מנותק
                    א.מ.ד.
                    מדריכים
                    כתב נערך לאחרונה על ידי
                    #122

                    @חובבן-מקצועי אגב, יש שאלה שאני אוהב לשאול מודלים קטנים, ולראות את תגובתם - לסאלי יש 3 אחים. לכל אחד מאחיה יש 2 אחיות. כמה אחיות יש לסאלי?
                    התשובה היא כמובן 1, אבל רוב המודלים הקטנים עונים 6, 5 או 2...

                    מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

                    חובבן מקצועיח CSS 0C 2 תגובות תגובה אחרונה
                    0
                    • א.מ.ד.א א.מ.ד.

                      @חובבן-מקצועי אגב, יש שאלה שאני אוהב לשאול מודלים קטנים, ולראות את תגובתם - לסאלי יש 3 אחים. לכל אחד מאחיה יש 2 אחיות. כמה אחיות יש לסאלי?
                      התשובה היא כמובן 1, אבל רוב המודלים הקטנים עונים 6, 5 או 2...

                      חובבן מקצועיח מנותק
                      חובבן מקצועיח מנותק
                      חובבן מקצועי
                      כתב נערך לאחרונה על ידי חובבן מקצועי
                      #123

                      @א.מ.ד. כתב:

                      התשובה היא כמובן 1, אבל רוב המודלים הקטנים עונים 6, 5 או 2...

                      gemma 4 E2b ענה תשובה נכונה.. (שאגב, מוזר שהוא לא עונה נכונה על השאלה של 'לאמא של דני יש שלושה ילדים, אברהם יצחק ו? (הוא עונה 'אנא ספק לי עוד מידע') ולשאלה הזו E4B עונה מצויין.)

                      תגובה 1 תגובה אחרונה
                      1
                      • א.מ.ד.א א.מ.ד.

                        @חובבן-מקצועי אגב, יש שאלה שאני אוהב לשאול מודלים קטנים, ולראות את תגובתם - לסאלי יש 3 אחים. לכל אחד מאחיה יש 2 אחיות. כמה אחיות יש לסאלי?
                        התשובה היא כמובן 1, אבל רוב המודלים הקטנים עונים 6, 5 או 2...

                        CSS 0C מחובר
                        CSS 0C מחובר
                        CSS 0
                        מדריכים
                        כתב נערך לאחרונה על ידי
                        #124

                        @א.מ.ד. לי gemma4E4B אומר 2 (כי הוא טוען שסאלי זה שם שבן ולא מוכן להסכים איתי...) ו E2B בכלל נע בין 6\5\4\3\2

                        https://iosii123212-hub.github.io/ani/

                        חובבן מקצועיח תגובה 1 תגובה אחרונה
                        😂
                        0
                        • CSS 0C CSS 0

                          @א.מ.ד. לי gemma4E4B אומר 2 (כי הוא טוען שסאלי זה שם שבן ולא מוכן להסכים איתי...) ו E2B בכלל נע בין 6\5\4\3\2

                          חובבן מקצועיח מנותק
                          חובבן מקצועיח מנותק
                          חובבן מקצועי
                          כתב נערך לאחרונה על ידי
                          #125

                          @CSS-0 תבדוק, אולי במקרה כיבית את מצב חשיבה? זה משפיע על התשובה.

                          CSS 0C תגובה 1 תגובה אחרונה
                          0
                          • חובבן מקצועיח חובבן מקצועי

                            @CSS-0 תבדוק, אולי במקרה כיבית את מצב חשיבה? זה משפיע על התשובה.

                            CSS 0C מחובר
                            CSS 0C מחובר
                            CSS 0
                            מדריכים
                            כתב נערך לאחרונה על ידי
                            #126

                            @חובבן-מקצועי אני אף פעם לא מפעיל אני אוהב לבחון אותם רק כשהחשיבה כבויה אחרי ששיניתי את החידה הוא סוף סוף ענה ששאלתי במקום "סאלי" כתבתי לו "רבקה" ... ובקיצור על החידה של הלאמא של דני.. וכ"ו הוא ענה יפה נכון.

                            https://iosii123212-hub.github.io/ani/

                            תגובה 1 תגובה אחרונה
                            0
                            • א.מ.ד.א א.מ.ד.

                              @פתרון-AI אין לך צורך בתוכנה שלי בשביל מודלים בינוניים. אתה יכול להריץ אותם כרגיל עם LM Studio, במהירות מטורפת.
                              אני מדבר על מודלי MoE עד 40B, או מודלים צפופים עד כ-14B. אבל גם מודלים צפופים של 30B יעבדו מהר יחסית ע"י העברת חלק מהשכבות ל-GPU. אז תנסה את סדרות Gemma 4 ו-Qwen 3.6.
                              אם בכל זאת תרצה להריץ מודלי MoE גדולים יותר כמו Qwen 3.5 122B A10B, תוכל להשתמש בתוכנה שלי. היא אמורה לתמוך ב-GPU, אבל אני צריך לבדוק את זה, כי מלכתחילה לא התעסקתי בחומרה חזקה. בגרסה הבאה זה יובא בחשבון.
                              @אריאלל זה עונה גם לשאלתך.

                              א מנותק
                              א מנותק
                              אריאלל
                              כתב נערך לאחרונה על ידי אריאלל
                              #127

                              @א.מ.ד. בדקתי את זה עכשיו, זה אמנם עובד באופן מצוין כלפי הטעינה החלקית לזיכרון, אבל ל-GPU זה לא טוען בכלל.

                              זה חשוב גם למחשבים כאלה, כי לי למשל יש VRAM של 6 GB שזה קצת באופן יחסי והשאר עובר ל-RAM מה שמאט את הביצועים משמעותית ומייתר למעשה את הכרטיס גרפי.

                              אם תוכל להתאים את התוכנה גם ל-GPU זה יעזור מאד.
                              תודה על ההשקעה👌
                              4eaa2528-98c1-4631-92f2-dff153e34562-image.jpeg

                              ה המלאךה 2 תגובות תגובה אחרונה
                              1
                              • א אריאלל

                                @א.מ.ד. בדקתי את זה עכשיו, זה אמנם עובד באופן מצוין כלפי הטעינה החלקית לזיכרון, אבל ל-GPU זה לא טוען בכלל.

                                זה חשוב גם למחשבים כאלה, כי לי למשל יש VRAM של 6 GB שזה קצת באופן יחסי והשאר עובר ל-RAM מה שמאט את הביצועים משמעותית ומייתר למעשה את הכרטיס גרפי.

                                אם תוכל להתאים את התוכנה גם ל-GPU זה יעזור מאד.
                                תודה על ההשקעה👌
                                4eaa2528-98c1-4631-92f2-dff153e34562-image.jpeg

                                ה מנותק
                                ה מנותק
                                החכם השלם
                                כתב נערך לאחרונה על ידי
                                #128

                                @אריאלל סתם ככה יש לך מעבד NPU שמותאם יותר לבינה מלאכותית, אין לי מושג אם כיום יש כלים שמנצלים אותו טוב יור מהתוצאות שהכרטיס הגרפי יביא, שווה לבדוק.

                                א תגובה 1 תגובה אחרונה
                                0
                                • ה החכם השלם

                                  @אריאלל סתם ככה יש לך מעבד NPU שמותאם יותר לבינה מלאכותית, אין לי מושג אם כיום יש כלים שמנצלים אותו טוב יור מהתוצאות שהכרטיס הגרפי יביא, שווה לבדוק.

                                  א מנותק
                                  א מנותק
                                  אריאלל
                                  כתב נערך לאחרונה על ידי
                                  #129

                                  @החכם-השלם זה NPU שיצא לפני עידן ה AI הביתי.
                                  יש לו אולי 7 TOPS, והוא נועד בעיקר לתכונות במצלמה כמו מעקב פנים וטשטוש.

                                  תגובה 1 תגובה אחרונה
                                  0
                                  • א אריאלל

                                    @א.מ.ד. בדקתי את זה עכשיו, זה אמנם עובד באופן מצוין כלפי הטעינה החלקית לזיכרון, אבל ל-GPU זה לא טוען בכלל.

                                    זה חשוב גם למחשבים כאלה, כי לי למשל יש VRAM של 6 GB שזה קצת באופן יחסי והשאר עובר ל-RAM מה שמאט את הביצועים משמעותית ומייתר למעשה את הכרטיס גרפי.

                                    אם תוכל להתאים את התוכנה גם ל-GPU זה יעזור מאד.
                                    תודה על ההשקעה👌
                                    4eaa2528-98c1-4631-92f2-dff153e34562-image.jpeg

                                    המלאךה מנותק
                                    המלאךה מנותק
                                    המלאך
                                    כתב נערך לאחרונה על ידי
                                    #130

                                    @אריאלל אולי זה יעזור לך.
                                    https://github.com/lyogavin/airllm

                                    האתר שלי: https://amlaach.github.io/personal-site/

                                    cfopuserC תגובה 1 תגובה אחרונה
                                    2
                                    • המלאךה המלאך

                                      @אריאלל אולי זה יעזור לך.
                                      https://github.com/lyogavin/airllm

                                      cfopuserC מנותק
                                      cfopuserC מנותק
                                      cfopuser
                                      כתב נערך לאחרונה על ידי
                                      #131

                                      @המלאך מה המהירות של זה?

                                      Kimi K3 (2.8T) — the largest open-source model released to date — on under 4GB
                                      
                                      המלאךה תגובה 1 תגובה אחרונה
                                      1
                                      • cfopuserC cfopuser

                                        @המלאך מה המהירות של זה?

                                        Kimi K3 (2.8T) — the largest open-source model released to date — on under 4GB
                                        
                                        המלאךה מנותק
                                        המלאךה מנותק
                                        המלאך
                                        כתב נערך לאחרונה על ידי
                                        #132

                                        @cfopuser איטי מאוד,
                                        אני מניח.

                                        האתר שלי: https://amlaach.github.io/personal-site/

                                        תגובה 1 תגובה אחרונה
                                        2

                                        שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.

                                        נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.

                                        בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗

                                        הרשמה התחברות

                                        • התחברות

                                        • אין לך חשבון עדיין? הרשמה

                                        • התחברו או הירשמו כדי לחפש.
                                        • פוסט ראשון
                                          פוסט אחרון
                                        0
                                        • חוקי הפורום
                                        • פופולרי
                                        • לא נפתר
                                        • משתמשים
                                        • חיפוש גוגל בפורום
                                        • צור קשר