דילוג לתוכן
  • חוקי הפורום
  • פופולרי
  • לא נפתר
  • משתמשים
  • חיפוש גוגל בפורום
  • צור קשר
עיצובים
  • בהיר
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • כהה
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • ברירת מחדל (ללא עיצוב (ברירת מחדל))
  • ללא עיצוב (ברירת מחדל)
כיווץ
מתמחים טופ
  1. דף הבית
  2. קטגוריות בהרצה
  3. תכנות
  4. בינה מלאכותית - AI
  5. עזרה הדדית - בינה מלאכותית
  6. SparkMoE - מערכת להרצת מודלי AI גדולים ועוצמתיים באופן מקומי על חומרה חלשה, עדכון - גרסה V0.3.0!

SparkMoE - מערכת להרצת מודלי AI גדולים ועוצמתיים באופן מקומי על חומרה חלשה, עדכון - גרסה V0.3.0!

מתוזמן נעוץ נעול הועבר עזרה הדדית - בינה מלאכותית
147 פוסטים 26 כותבים 5.5k צפיות 31 עוקבים
  • מהישן לחדש
  • מהחדש לישן
  • הכי הרבה הצבעות
תגובה
  • תגובה כנושא
התחברו כדי לפרסם תגובה
נושא זה נמחק. רק משתמשים עם הרשאות מתאימות יוכלו לצפות בו.
  • המלאךה המלאך

    @החכם-השלם מה זה 'מספיק'?
    גם SSD אמור לעבוד (אלא אם המנגנון העברת נתונים עצמו שונה, אני לא כל כך מבין בזה..) רק שזה יהיה איטי להחריד, כאן זה שונה כי זה קורס..
    מסתמא זה בCPU או ראם, אבל מצד שני מודלים מקומיים רגילים בlama.cpp אתה טוען שאתה כן מצליח להריץ..

    CSS 0C מנותק
    CSS 0C מנותק
    CSS 0
    מדריכים מורחק
    כתב נערך לאחרונה על ידי
    #98

    @המלאך זה הלוגים, ותמיד אני מריץ עליו מודלים (אני מפעיל עליו מערכת טלפונית של AI מבוססת על מודל של 8B וזה עובד תקין וחלק בלי להאט לי את המחשב מעולם, המהירות אינטרנט זה 90MB לשניה, והמהירות שזה מחזיר למשתמש את התשובה זה ממוצע של 7 שניות, (וזה כולל המרה של הטקסט שהמודל מחזיר לשמע עם BlueTTS) אז אני לא חושב שאמור להיות בו בעיה...
    בכל מקרה זה הלוגים:

    0.00.009.579 I cmn  common_param: common_params_print_info: verbosity = 3 (adjust with the `-lv N` CLI arg)
    0.00.023.223 I srv    load_model: loading model 'C:\Users\USER\Downloads\gemma-4-26B-A4B-it-UD-IQ2_M.gguf'
    0.01.271.513 W common_fit_params: failed to fit params to free device memory: was unable to fit model into system memory by reducing context, abort
    0.02.162.598 W load: control-looking token:    212 '</s>' was not control-type; this is probably a bug in the model. its type will be overridden
    0.02.165.271 W load: control-looking token:     50 '<|tool_response>' was not control-type; this is probably a bug in the model. its type will be overridden
    0.02.177.253 W load: control-looking token:      1 '<eos>' was not control-type; this is probably a bug in the model. its type will be overridden
    0.02.215.972 W load: special_eog_ids contains '<|tool_response>', removing '</s>' token from EOG list
    1.02.461.952 W cmn  common_init_: KV cache shifting is not supported for this context, disabling KV cache shifting
    
    
    CSS 0C המלאךה א.מ.ד.א פ 4 תגובות תגובה אחרונה
    0
    • CSS 0C CSS 0

      @המלאך זה הלוגים, ותמיד אני מריץ עליו מודלים (אני מפעיל עליו מערכת טלפונית של AI מבוססת על מודל של 8B וזה עובד תקין וחלק בלי להאט לי את המחשב מעולם, המהירות אינטרנט זה 90MB לשניה, והמהירות שזה מחזיר למשתמש את התשובה זה ממוצע של 7 שניות, (וזה כולל המרה של הטקסט שהמודל מחזיר לשמע עם BlueTTS) אז אני לא חושב שאמור להיות בו בעיה...
      בכל מקרה זה הלוגים:

      0.00.009.579 I cmn  common_param: common_params_print_info: verbosity = 3 (adjust with the `-lv N` CLI arg)
      0.00.023.223 I srv    load_model: loading model 'C:\Users\USER\Downloads\gemma-4-26B-A4B-it-UD-IQ2_M.gguf'
      0.01.271.513 W common_fit_params: failed to fit params to free device memory: was unable to fit model into system memory by reducing context, abort
      0.02.162.598 W load: control-looking token:    212 '</s>' was not control-type; this is probably a bug in the model. its type will be overridden
      0.02.165.271 W load: control-looking token:     50 '<|tool_response>' was not control-type; this is probably a bug in the model. its type will be overridden
      0.02.177.253 W load: control-looking token:      1 '<eos>' was not control-type; this is probably a bug in the model. its type will be overridden
      0.02.215.972 W load: special_eog_ids contains '<|tool_response>', removing '</s>' token from EOG list
      1.02.461.952 W cmn  common_init_: KV cache shifting is not supported for this context, disabling KV cache shifting
      
      
      CSS 0C מנותק
      CSS 0C מנותק
      CSS 0
      מדריכים מורחק
      כתב נערך לאחרונה על ידי
      #99

      והפעם זה החזיר את זה בלי להאט את המחשב..

      תגובה 1 תגובה אחרונה
      0
      • CSS 0C CSS 0

        @המלאך זה הלוגים, ותמיד אני מריץ עליו מודלים (אני מפעיל עליו מערכת טלפונית של AI מבוססת על מודל של 8B וזה עובד תקין וחלק בלי להאט לי את המחשב מעולם, המהירות אינטרנט זה 90MB לשניה, והמהירות שזה מחזיר למשתמש את התשובה זה ממוצע של 7 שניות, (וזה כולל המרה של הטקסט שהמודל מחזיר לשמע עם BlueTTS) אז אני לא חושב שאמור להיות בו בעיה...
        בכל מקרה זה הלוגים:

        0.00.009.579 I cmn  common_param: common_params_print_info: verbosity = 3 (adjust with the `-lv N` CLI arg)
        0.00.023.223 I srv    load_model: loading model 'C:\Users\USER\Downloads\gemma-4-26B-A4B-it-UD-IQ2_M.gguf'
        0.01.271.513 W common_fit_params: failed to fit params to free device memory: was unable to fit model into system memory by reducing context, abort
        0.02.162.598 W load: control-looking token:    212 '</s>' was not control-type; this is probably a bug in the model. its type will be overridden
        0.02.165.271 W load: control-looking token:     50 '<|tool_response>' was not control-type; this is probably a bug in the model. its type will be overridden
        0.02.177.253 W load: control-looking token:      1 '<eos>' was not control-type; this is probably a bug in the model. its type will be overridden
        0.02.215.972 W load: special_eog_ids contains '<|tool_response>', removing '</s>' token from EOG list
        1.02.461.952 W cmn  common_init_: KV cache shifting is not supported for this context, disabling KV cache shifting
        
        
        המלאךה מנותק
        המלאךה מנותק
        המלאך
        כתב נערך לאחרונה על ידי המלאך
        #100

        @CSS-0 תביא ל @א.מ.ד. .
        בכל מקרה סתם סקרנות, המחשב שלך מחובר כאילו כל הזמן לחשמל ולאינטרנט?

        האתר שלי: https://amlaach.github.io/personal-site/

        CSS 0C תגובה 1 תגובה אחרונה
        0
        • המלאךה המלאך

          @CSS-0 תביא ל @א.מ.ד. .
          בכל מקרה סתם סקרנות, המחשב שלך מחובר כאילו כל הזמן לחשמל ולאינטרנט?

          CSS 0C מנותק
          CSS 0C מנותק
          CSS 0
          מדריכים מורחק
          כתב נערך לאחרונה על ידי
          #101

          @המלאך כן..

          תגובה 1 תגובה אחרונה
          🤔
          0
          • CSS 0C CSS 0

            @המלאך זה הלוגים, ותמיד אני מריץ עליו מודלים (אני מפעיל עליו מערכת טלפונית של AI מבוססת על מודל של 8B וזה עובד תקין וחלק בלי להאט לי את המחשב מעולם, המהירות אינטרנט זה 90MB לשניה, והמהירות שזה מחזיר למשתמש את התשובה זה ממוצע של 7 שניות, (וזה כולל המרה של הטקסט שהמודל מחזיר לשמע עם BlueTTS) אז אני לא חושב שאמור להיות בו בעיה...
            בכל מקרה זה הלוגים:

            0.00.009.579 I cmn  common_param: common_params_print_info: verbosity = 3 (adjust with the `-lv N` CLI arg)
            0.00.023.223 I srv    load_model: loading model 'C:\Users\USER\Downloads\gemma-4-26B-A4B-it-UD-IQ2_M.gguf'
            0.01.271.513 W common_fit_params: failed to fit params to free device memory: was unable to fit model into system memory by reducing context, abort
            0.02.162.598 W load: control-looking token:    212 '</s>' was not control-type; this is probably a bug in the model. its type will be overridden
            0.02.165.271 W load: control-looking token:     50 '<|tool_response>' was not control-type; this is probably a bug in the model. its type will be overridden
            0.02.177.253 W load: control-looking token:      1 '<eos>' was not control-type; this is probably a bug in the model. its type will be overridden
            0.02.215.972 W load: special_eog_ids contains '<|tool_response>', removing '</s>' token from EOG list
            1.02.461.952 W cmn  common_init_: KV cache shifting is not supported for this context, disabling KV cache shifting
            
            
            א.מ.ד.א מחובר
            א.מ.ד.א מחובר
            א.מ.ד.
            מדריכים
            כתב נערך לאחרונה על ידי
            #102

            @CSS-0 כנראה אין לך מספיק ram פנוי בשביל בפרמטרים הפעילים. תנסה לשחק עם גודל המטמון בממשק הבקרה.

            מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

            CSS 0C תגובה 1 תגובה אחרונה
            0
            • א.מ.ד.א א.מ.ד.

              @CSS-0 כנראה אין לך מספיק ram פנוי בשביל בפרמטרים הפעילים. תנסה לשחק עם גודל המטמון בממשק הבקרה.

              CSS 0C מנותק
              CSS 0C מנותק
              CSS 0
              מדריכים מורחק
              כתב נערך לאחרונה על ידי
              #103

              @א.מ.ד. כתב:

              כנראה אין לך מספיק ram פנוי בשביל בפרמטרים הפעילים. תנסה לשחק עם גודל המטמון בממשק הבקרה.

              אולי כי מופעל כבר מודל של 8B על המחשב?

              בנימין מחשביםב תגובה 1 תגובה אחרונה
              😂
              0
              • CSS 0C CSS 0

                @א.מ.ד. כתב:

                כנראה אין לך מספיק ram פנוי בשביל בפרמטרים הפעילים. תנסה לשחק עם גודל המטמון בממשק הבקרה.

                אולי כי מופעל כבר מודל של 8B על המחשב?

                בנימין מחשביםב מנותק
                בנימין מחשביםב מנותק
                בנימין מחשבים
                מדריכים
                כתב נערך לאחרונה על ידי
                #104

                @CSS-0 😂 😂 😂
                אולי באמת...

                יש 10 סוגים של אנשים, אלה שמבינים בינארית ואלה שלא

                CSS 0C תגובה 1 תגובה אחרונה
                😂
                0
                • בנימין מחשביםב בנימין מחשבים

                  @CSS-0 😂 😂 😂
                  אולי באמת...

                  CSS 0C מנותק
                  CSS 0C מנותק
                  CSS 0
                  מדריכים מורחק
                  כתב נערך לאחרונה על ידי
                  #105

                  @בנימין-מחשבים כתב:

                  אולי באמת...

                  זה היה בצחוק...

                  תגובה 1 תגובה אחרונה
                  0
                  • המלאךה המלאך

                    @פתרון-AI אתה רוצה לקידוד?
                    או למידי בעלמא?

                    פ מנותק
                    פ מנותק
                    פתרון AI
                    כתב נערך לאחרונה על ידי
                    #106

                    @המלאך אני רוצה לקידוד או בדיקת קוד ומציאת שגיאות או כל עבודה של פיתוח שיכול לעזור לי
                    מה זה מידי בעלמא?
                    @א.מ.ד. תודה רבה מחכים לגרסה הבאה שבאמת אוכל להריץ מודלים חזקים שיהיו תחליף לחלק מהעבודה בקלוד וGPT

                    המלאךה תגובה 1 תגובה אחרונה
                    0
                    • פ פתרון AI

                      @המלאך אני רוצה לקידוד או בדיקת קוד ומציאת שגיאות או כל עבודה של פיתוח שיכול לעזור לי
                      מה זה מידי בעלמא?
                      @א.מ.ד. תודה רבה מחכים לגרסה הבאה שבאמת אוכל להריץ מודלים חזקים שיהיו תחליף לחלק מהעבודה בקלוד וGPT

                      המלאךה מנותק
                      המלאךה מנותק
                      המלאך
                      כתב נערך לאחרונה על ידי
                      #107

                      @פתרון-AI אז הqwen ש @א.מ.ד. המליץ.

                      האתר שלי: https://amlaach.github.io/personal-site/

                      פ תגובה 1 תגובה אחרונה
                      1
                      • CSS 0C CSS 0

                        @המלאך זה הלוגים, ותמיד אני מריץ עליו מודלים (אני מפעיל עליו מערכת טלפונית של AI מבוססת על מודל של 8B וזה עובד תקין וחלק בלי להאט לי את המחשב מעולם, המהירות אינטרנט זה 90MB לשניה, והמהירות שזה מחזיר למשתמש את התשובה זה ממוצע של 7 שניות, (וזה כולל המרה של הטקסט שהמודל מחזיר לשמע עם BlueTTS) אז אני לא חושב שאמור להיות בו בעיה...
                        בכל מקרה זה הלוגים:

                        0.00.009.579 I cmn  common_param: common_params_print_info: verbosity = 3 (adjust with the `-lv N` CLI arg)
                        0.00.023.223 I srv    load_model: loading model 'C:\Users\USER\Downloads\gemma-4-26B-A4B-it-UD-IQ2_M.gguf'
                        0.01.271.513 W common_fit_params: failed to fit params to free device memory: was unable to fit model into system memory by reducing context, abort
                        0.02.162.598 W load: control-looking token:    212 '</s>' was not control-type; this is probably a bug in the model. its type will be overridden
                        0.02.165.271 W load: control-looking token:     50 '<|tool_response>' was not control-type; this is probably a bug in the model. its type will be overridden
                        0.02.177.253 W load: control-looking token:      1 '<eos>' was not control-type; this is probably a bug in the model. its type will be overridden
                        0.02.215.972 W load: special_eog_ids contains '<|tool_response>', removing '</s>' token from EOG list
                        1.02.461.952 W cmn  common_init_: KV cache shifting is not supported for this context, disabling KV cache shifting
                        
                        
                        פ מנותק
                        פ מנותק
                        פתרון AI
                        כתב נערך לאחרונה על ידי
                        #108

                        @CSS-0 נשמח שתשתף אותנו במערכת הזאת נשמע מאוד מעניין

                        CSS 0C תגובה 1 תגובה אחרונה
                        0
                        • המלאךה המלאך

                          @פתרון-AI אז הqwen ש @א.מ.ד. המליץ.

                          פ מנותק
                          פ מנותק
                          פתרון AI
                          כתב נערך לאחרונה על ידי
                          #109

                          @המלאך איך אני מתחיל איתו יש איזה מדריך פשוט איך מתחילים עם המודל הזה?

                          המלאךה תגובה 1 תגובה אחרונה
                          0
                          • פ פתרון AI

                            @המלאך איך אני מתחיל איתו יש איזה מדריך פשוט איך מתחילים עם המודל הזה?

                            המלאךה מנותק
                            המלאךה מנותק
                            המלאך
                            כתב נערך לאחרונה על ידי המלאך
                            #110

                            @פתרון-AI הכי פשוט זה lm סטודיו.
                            יש מדריך של @חובבן-מקצועי
                            חפש באחד הנושאים שלו.

                            עריכה: https://mitmachim.top/topic/95704/מדריך-מדריך-בסיסי-להתקנה-ושימוש-במודלים-ב-lm-studio

                            האתר שלי: https://amlaach.github.io/personal-site/

                            תגובה 1 תגובה אחרונה
                            0
                            • פ פתרון AI

                              @CSS-0 נשמח שתשתף אותנו במערכת הזאת נשמע מאוד מעניין

                              CSS 0C מנותק
                              CSS 0C מנותק
                              CSS 0
                              מדריכים מורחק
                              כתב נערך לאחרונה על ידי
                              #111

                              @פתרון-AI עזוב זה משהו שאני מפיץ במעגל סגור יש ממש אנשים בודדים שנתתי בפרטי, חוץ מזה השיעור שלי בישיבה מחובר לזה וטו לא..

                              פ תגובה 1 תגובה אחרונה
                              🙄
                              0
                              • CSS 0C CSS 0

                                @פתרון-AI עזוב זה משהו שאני מפיץ במעגל סגור יש ממש אנשים בודדים שנתתי בפרטי, חוץ מזה השיעור שלי בישיבה מחובר לזה וטו לא..

                                פ מנותק
                                פ מנותק
                                פתרון AI
                                כתב נערך לאחרונה על ידי
                                #112

                                @CSS-0 אשמח שתשתף אותי בפרטי
                                admin@pitronai.com
                                אם אתה רוצה
                                אם תרצה שלא אשתמש לא אשתמש בה רק בשביל הידע אני קצת חוקר את הנושא ולכן כל ידע בנושא עוזר לי

                                תגובה 1 תגובה אחרונה
                                0
                                • א.מ.ד.א א.מ.ד.

                                  SparkMoE

                                  SparkMoE.png

                                  בהשראת הפרויקט שהוזכר כאן ע"י @המלאך - בשם colibri, שבו קבוצת חוקרים הצליחו להריץ את המודל העוצמתי GLM 5.2 על חומרה ביתית, עם כמה עשרות GB RAM "בלבד" (לצורך ההרצה נטו נצרכו כ-25 RAM), החלטתי ליצור פרויקט דומה אך שונה, שיתאים לחומרה חלשה באמת ויריץ מודלי MoE בגודל בינוני, כמו Qwen 3.6 35B A3B ו-Gemma 4 26B A4B, במכשירים עם 8/16 GB RAM (לא נבדק על 8 RAM, אבל אמור לעבוד באותה מידה).
                                  לכאורה זה אמור להתאים גם להרצת מודלי MoE גדולים מאוד של מאות B פרמטרים על חומרה בינונית (32 GB RAM ומעלה), אבל לצערי אין לי חומרה כזו כך שאין לי איך לנסות אם זה באמת עובד...

                                  הרעיון המרכזי שעומד מאחורי הפרויקט הוא השארת המודל המלא על ה-SSD (כונן האחסון), וטעינת ופריקת מומחי ה-MoE באופן דינמי ל-RAM לפי הצורך. זה מאפשר הרצת מודלים בינוניים (20-40B פרמטרים) על גבי מכשירים עם RAM צרכני קלאסי, אף ללא GPU, מכיון שלא מתבצעת טעינה מלאה של כלל המודל ל-RAM.

                                  כרגע הצלחתי להגיע ב-SparkMoE במודל Qwen 3.6 35B A3B עם MTP מופעל לבערך 4 טוקנים לשניה - איטי אבל שמיש. בגרסאות הבאות בעז"ה אני אנסה להאיץ ככל האפשר את ההסקה.
                                  המהירות תלויה במהירות הקריאה מה-SSD, מספר ליבות ושרשורי מעבד, רוחב פס ועוד, לכן במחשב שמצטיין באלה ההסקה תהיה מהירה יותר.

                                  שימו לב: בהרצה הראשונה של המודל לאחר הפעלת השרת המקומי, ההסקה איטית יותר, אך עם התקדמות היצירה ההסקה מאיצה, בשל כך שחלק מהמומחים שכבר היו בשימוש כבר נמצאים במטמון המהיר יותר מה-SSD.

                                  SparkMoE תומך בכל הפונקציונליות הקיימת של פרוייקט llama.cpp המקורי, כמו MTP, שרת OpenAI מקומי ועוד.
                                  כמו כן, SparkMoE תומך גם במודלים צפופים רגילים, לא רק במודלי MoE, אבל במודלים רגילים ההסקה היא רק בגודל מודל סטנדרטי.

                                  אופן ההרצה:

                                  כדי להריץ מודל גדול עם SparkMoE, יש להפעיל את התוכנה, ובממשק הדשבורד המופיע בדפדפן יש לבחור (בהפעלה הראשונה) בתיקיית מודלים (גם תתי-תיקיות נתמכות, כך שאפשר להשתמש בתיקיית Models של LM Studio), לבחור מודל, ואז ללחוץ על "הפעל מודל". להמתין לטעינת המודל עד שכפתור "פתיחת הצ'אט" נהיה זמין.
                                  בלחיצה על "פתיחת הצ'אט", ייפתח בכרטיסיה חדשה בדפדפן ממשק הצ'אט של SparkMoE.
                                  בממשק הצ'אט ניתן לשנות הגדרות רבות, כמו MTP, הודעת מערכת, פרמטרי הסקה ועוד, בלשונית "הגדרות". ניתן גם להגדיר רמת חשיבה.


                                  תמונות לדוגמה:

                                  ניהול השרת:
                                  6d7ef604-32e0-4b68-8f6c-773ccdb6559b-image.jpeg

                                  ממשק הצ'אט והגדרות ההסקה:
                                  f5f0944b-c2e3-4392-a1b9-f21faeea4b72-image.jpeg


                                  מודלים תואמים מומלצים:

                                  כרגע עדיין אסור ע"פ חוקי הפורום להעלות מודלי AI באופן ישיר בשל "פריצת סינונים", אבל מצורפים כמה קישורים עבור מודלי MoE בגודל בינוני, במידה והם פתוחים בסינון המותקן אצלכם:

                                  • Qwen 3.6 35B A3B MTP
                                  • Gemma 4 26B A4B

                                  מומלץ להוריד את קוונטיזציית Q4 של כל מודל, או IQ4 אם קיים.
                                  אם החומרה שברשותכם בעלת 32 GB RAM ומעלה, אפשר להתקדם למודלי MoE גדולים יותר.

                                  עדכונים:

                                  • עדכון V0.3.0:
                                    תוקנה תמיכה במודל Gemma 4 26B, שיפורי מהירות בכלל מודלי MoE, ותיקוני באגים.

                                  הורדה:

                                  הפרוייקט זמין בקוד פתוח בגיטהאב, ראו כאן.
                                  ניתן להוריד קובץ EXE להתקנה מהירה מה-releases, או גרסת ZIP ניידת (לחלץ לתיקיה ולהפעיל את SparkMoE.exe).
                                  אל תשכחו לשים ⭐ במאגר בגיטהאב על הדרך!
                                  (הקוד המקורי של llama.cpp ברישיון MIT, והחלקים שלי תחת רישיון לא מסחרי).


                                  אשמח לשמוע על המהירות והביצועים של המודלים השונים על חומרות שונות, וכן לקבל משוב על התוכנה עצמה!

                                  ר מנותק
                                  ר מנותק
                                  רפי סאם
                                  כתב נערך לאחרונה על ידי
                                  #113

                                  @א.מ.ד. אני ממליץ על המודול gemma-3-1b-it-Q8_0.gguf - 1020 MiB
                                  הוא מאוד מהיר ונוח על מחשב של 16 ראם

                                  חובבן מקצועיח 2 תגובות תגובה אחרונה
                                  0
                                  • ר רפי סאם

                                    @א.מ.ד. אני ממליץ על המודול gemma-3-1b-it-Q8_0.gguf - 1020 MiB
                                    הוא מאוד מהיר ונוח על מחשב של 16 ראם

                                    חובבן מקצועיח מנותק
                                    חובבן מקצועיח מנותק
                                    חובבן מקצועי
                                    כתב נערך לאחרונה על ידי חובבן מקצועי
                                    #114

                                    @רפי-סאם אתה בטוח? הוא ממש טיפש..
                                    עדיף לעבוד על gemma מסדרה 4. (יש לך את gemma 4 E2b שהוא שוקל 3.5 GB)

                                    ר תגובה 1 תגובה אחרונה
                                    0
                                    • חובבן מקצועיח חובבן מקצועי

                                      @רפי-סאם אתה בטוח? הוא ממש טיפש..
                                      עדיף לעבוד על gemma מסדרה 4. (יש לך את gemma 4 E2b שהוא שוקל 3.5 GB)

                                      ר מנותק
                                      ר מנותק
                                      רפי סאם
                                      כתב נערך לאחרונה על ידי רפי סאם
                                      #115

                                      @חובבן-מקצועי המהירות מפצה...
                                      עריכה כתבתי לפני שהו כתב על גמא 4

                                      המלאךה חובבן מקצועיח 2 תגובות תגובה אחרונה
                                      0
                                      • ר רפי סאם

                                        @חובבן-מקצועי המהירות מפצה...
                                        עריכה כתבתי לפני שהו כתב על גמא 4

                                        המלאךה מנותק
                                        המלאךה מנותק
                                        המלאך
                                        כתב נערך לאחרונה על ידי
                                        #116

                                        @רפי-סאם מה פתאום?
                                        זה אותו כימות.
                                        ההבדל מיזערי.

                                        האתר שלי: https://amlaach.github.io/personal-site/

                                        תגובה 1 תגובה אחרונה
                                        0
                                        • ר רפי סאם

                                          @חובבן-מקצועי המהירות מפצה...
                                          עריכה כתבתי לפני שהו כתב על גמא 4

                                          חובבן מקצועיח מנותק
                                          חובבן מקצועיח מנותק
                                          חובבן מקצועי
                                          כתב נערך לאחרונה על ידי
                                          #117

                                          @רפי-סאם כתב:

                                          @חובבן-מקצועי המהירות מפצה...

                                          לדעתי היא לא מפצה על כלום (לפי מה שזכור לי על המודל ההוא כשהרצתי אותו בעבר), gemma 3 בכלל - הוא מהסוג הישן - בלי חשיבה, ועוד כזה קצת פרמטרים..

                                          תגובה 1 תגובה אחרונה
                                          🙄
                                          0

                                          שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.

                                          נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.

                                          בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗

                                          הרשמה התחברות

                                          • התחברות

                                          • אין לך חשבון עדיין? הרשמה

                                          • התחברו או הירשמו כדי לחפש.
                                          • פוסט ראשון
                                            פוסט אחרון
                                          0
                                          • חוקי הפורום
                                          • פופולרי
                                          • לא נפתר
                                          • משתמשים
                                          • חיפוש גוגל בפורום
                                          • צור קשר