דילוג לתוכן
  • חוקי הפורום
  • פופולרי
  • לא נפתר
  • משתמשים
  • חיפוש גוגל בפורום
  • צור קשר
עיצובים
  • בהיר
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • כהה
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • ברירת מחדל (ללא עיצוב (ברירת מחדל))
  • ללא עיצוב (ברירת מחדל)
כיווץ
מתמחים טופ
  1. דף הבית
  2. קטגוריות בהרצה
  3. תכנות
  4. בינה מלאכותית - AI
  5. עזרה הדדית - בינה מלאכותית
  6. SparkMoE - מערכת להרצת מודלי AI גדולים ועוצמתיים באופן מקומי על חומרה חלשה, עדכון - גרסה V0.3.0!

SparkMoE - מערכת להרצת מודלי AI גדולים ועוצמתיים באופן מקומי על חומרה חלשה, עדכון - גרסה V0.3.0!

מתוזמן נעוץ נעול הועבר עזרה הדדית - בינה מלאכותית
85 פוסטים 20 כותבים 1.6k צפיות 26 עוקבים
  • מהישן לחדש
  • מהחדש לישן
  • הכי הרבה הצבעות
תגובה
  • תגובה כנושא
התחברו כדי לפרסם תגובה
נושא זה נמחק. רק משתמשים עם הרשאות מתאימות יוכלו לצפות בו.
  • הישבשר המלומדה הישבשר המלומד

    @א.מ.ד. אם יש לי מחשב קלאסי עם 16 RAM עם התוכנה שלך איזה מודל הוא הכי טוב לי לשימוש יום יומי לצורך קידוד וסתם דיבורים וכו' (והאם ביחד עם התוכנה הזאת אני יוכל להריץ את התוכנה שלך (סמרטי) עם מודל אופליין גדול)?

    י מנותק
    י מנותק
    ישראל123
    כתב נערך לאחרונה על ידי
    #63

    @א.מ.ד. כתבתי לך בצ'אט לגבי טעינת מודלי עזר (אני רוצה ליצור PR עם מה שעשיתי ושתבדוק את זה)

    הישבשר המלומדה א.מ.ד.א 2 תגובות תגובה אחרונה
    0
    • י ישראל123

      @א.מ.ד. כתבתי לך בצ'אט לגבי טעינת מודלי עזר (אני רוצה ליצור PR עם מה שעשיתי ושתבדוק את זה)

      הישבשר המלומדה מנותק
      הישבשר המלומדה מנותק
      הישבשר המלומד
      מדריכים
      כתב נערך לאחרונה על ידי
      #64

      @ישראל123

      אל תתיג את הפוסט שלי, כאילו בכללי תתיג את מה שאתה עונה לו 😊

      תגובה 1 תגובה אחרונה
      1
      • הישבשר המלומדה הישבשר המלומד

        @א.מ.ד. אם יש לי מחשב קלאסי עם 16 RAM עם התוכנה שלך איזה מודל הוא הכי טוב לי לשימוש יום יומי לצורך קידוד וסתם דיבורים וכו' (והאם ביחד עם התוכנה הזאת אני יוכל להריץ את התוכנה שלך (סמרטי) עם מודל אופליין גדול)?

        המלאךה מנותק
        המלאךה מנותק
        המלאך
        כתב נערך לאחרונה על ידי
        #65

        @הישבשר-המלומד יש לך כרטיס מסך?
        באופן כללי התוכנה שלו איטית הרבה יותר מlama.cpp,
        אבל אם בכל את תרצה - כל מודל MoE נתמך.
        בשבילך - Gemma 4.

        "Code shapes logic, AI expands vision."

        א.מ.ד.א תגובה 1 תגובה אחרונה
        0
        • הישבשר המלומדה הישבשר המלומד

          @א.מ.ד. אם יש לי מחשב קלאסי עם 16 RAM עם התוכנה שלך איזה מודל הוא הכי טוב לי לשימוש יום יומי לצורך קידוד וסתם דיבורים וכו' (והאם ביחד עם התוכנה הזאת אני יוכל להריץ את התוכנה שלך (סמרטי) עם מודל אופליין גדול)?

          א.מ.ד.א מחובר
          א.מ.ד.א מחובר
          א.מ.ד.
          מדריכים
          כתב נערך לאחרונה על ידי א.מ.ד.
          #66

          @הישבשר-המלומד כתב:

          @א.מ.ד. אם יש לי מחשב קלאסי עם 16 RAM עם התוכנה שלך איזה מודל הוא הכי טוב לי לשימוש יום יומי לצורך קידוד וסתם דיבורים וכו' (והאם ביחד עם התוכנה הזאת אני יוכל להריץ את התוכנה שלך (סמרטי) עם מודל אופליין גדול)?

          Qwen 3.6 35B לקידוד, Gemma 4 26B לשימוש כללי.

          מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

          הישבשר המלומדה תגובה 1 תגובה אחרונה
          0
          • המלאךה המלאך

            @הישבשר-המלומד יש לך כרטיס מסך?
            באופן כללי התוכנה שלו איטית הרבה יותר מlama.cpp,
            אבל אם בכל את תרצה - כל מודל MoE נתמך.
            בשבילך - Gemma 4.

            א.מ.ד.א מחובר
            א.מ.ד.א מחובר
            א.מ.ד.
            מדריכים
            כתב נערך לאחרונה על ידי
            #67

            @המלאך כתב:

            באופן כללי התוכנה שלו איטית הרבה יותר מlama.cpp,

            ברור, כי היא מריצה את רוב המודל על האחסון במקום בראם, שטוען רק כמה שהוא יכול ותו לא. מטרת התוכנה היא לאפשר בכל זאת, אמנם באיטיות, הרצת מודלים גדולים על חומרה חלשה. אגב, מהירות של 4 טוק' לשנייה זאת מהירות סבירה יחסית לגודל והחומרה.

            מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

            המלאךה תגובה 1 תגובה אחרונה
            0
            • י ישראל123

              @א.מ.ד. כתבתי לך בצ'אט לגבי טעינת מודלי עזר (אני רוצה ליצור PR עם מה שעשיתי ושתבדוק את זה)

              א.מ.ד.א מחובר
              א.מ.ד.א מחובר
              א.מ.ד.
              מדריכים
              כתב נערך לאחרונה על ידי
              #68

              @ישראל123 כתב:

              @א.מ.ד. כתבתי לך בצ'אט לגבי טעינת מודלי עזר (אני רוצה ליצור PR עם מה שעשיתי ושתבדוק את זה)

              אין צורך, אני עובד על זה לגרסה הבאה. תודה בכל אופן.

              מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

              י תגובה 1 תגובה אחרונה
              1
              • א.מ.ד.א א.מ.ד.

                @המלאך כתב:

                באופן כללי התוכנה שלו איטית הרבה יותר מlama.cpp,

                ברור, כי היא מריצה את רוב המודל על האחסון במקום בראם, שטוען רק כמה שהוא יכול ותו לא. מטרת התוכנה היא לאפשר בכל זאת, אמנם באיטיות, הרצת מודלים גדולים על חומרה חלשה. אגב, מהירות של 4 טוק' לשנייה זאת מהירות סבירה יחסית לגודל והחומרה.

                המלאךה מנותק
                המלאךה מנותק
                המלאך
                כתב נערך לאחרונה על ידי
                #69

                @א.מ.ד. כמובן.
                רק הערתי לו על מידת השימושיות שבזה.
                🙂

                "Code shapes logic, AI expands vision."

                תגובה 1 תגובה אחרונה
                1
                • א.מ.ד.א א.מ.ד.

                  @ישראל123 כתב:

                  @א.מ.ד. כתבתי לך בצ'אט לגבי טעינת מודלי עזר (אני רוצה ליצור PR עם מה שעשיתי ושתבדוק את זה)

                  אין צורך, אני עובד על זה לגרסה הבאה. תודה בכל אופן.

                  י מנותק
                  י מנותק
                  ישראל123
                  כתב נערך לאחרונה על ידי
                  #70

                  @א.מ.ד. מתי זה יצא?

                  תגובה 1 תגובה אחרונה
                  0
                  • הישבשר המלומדה הישבשר המלומד

                    @א.מ.ד. אם יש לי מחשב קלאסי עם 16 RAM עם התוכנה שלך איזה מודל הוא הכי טוב לי לשימוש יום יומי לצורך קידוד וסתם דיבורים וכו' (והאם ביחד עם התוכנה הזאת אני יוכל להריץ את התוכנה שלך (סמרטי) עם מודל אופליין גדול)?

                    א.מ.ד.א מחובר
                    א.מ.ד.א מחובר
                    א.מ.ד.
                    מדריכים
                    כתב נערך לאחרונה על ידי א.מ.ד.
                    #71

                    @הישבשר-המלומד כתב:

                    (והאם ביחד עם התוכנה הזאת אני יוכל להריץ את התוכנה שלך (סמרטי) עם מודל אופליין גדול)?

                    כן! כמובן באיטיות, אבל אם אין לך כרגע אינטרנט ואתה רוצה בכל זאת להשתמש בסמארטי, זה יכול להיות שימושי!
                    אבל כדאי שתחכה לגרסה הבאה של סמארטי, שחוסכת משמעותית בטוקנים (הצלחתי לצמצם את הנחיית המערכת לשאילתא בסיסית מכ-23,000 טוקנים לכ-5,000 טוקנים!), מה שאומר שהעיבוד יהיה מהיר בהרבה, וכוללת עוד התאמות להאצת העיבוד, והיא תכלול התאמה מיוחדת למודלים מקומיים שתצמצם עוד יותר את הנחיית המערכת ותסיר חלקים פחות חשובים.
                    לדוגמה מקודם השתמשתי בסמארטי עם Qwen 3.5 4B כדי לבדוק מזג אוויר, ותוך 2-3 דקות המשימה בוצעה בהצלחה (בעברית!).
                    72b67f0f-1bf8-4b59-85e5-86559e1c47d9-image.jpeg

                    מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

                    ה תגובה 1 תגובה אחרונה
                    2
                    • א.מ.ד.א א.מ.ד.

                      @הישבשר-המלומד כתב:

                      @א.מ.ד. אם יש לי מחשב קלאסי עם 16 RAM עם התוכנה שלך איזה מודל הוא הכי טוב לי לשימוש יום יומי לצורך קידוד וסתם דיבורים וכו' (והאם ביחד עם התוכנה הזאת אני יוכל להריץ את התוכנה שלך (סמרטי) עם מודל אופליין גדול)?

                      Qwen 3.6 35B לקידוד, Gemma 4 26B לשימוש כללי.

                      הישבשר המלומדה מנותק
                      הישבשר המלומדה מנותק
                      הישבשר המלומד
                      מדריכים
                      כתב נערך לאחרונה על ידי
                      #72

                      @א.מ.ד. בשביל זה אני גם צריך את התוכנה שלך או שאני יכול להריץ לבד,

                      א.מ.ד.א תגובה 1 תגובה אחרונה
                      0
                      • הישבשר המלומדה הישבשר המלומד

                        @א.מ.ד. בשביל זה אני גם צריך את התוכנה שלך או שאני יכול להריץ לבד,

                        א.מ.ד.א מחובר
                        א.מ.ד.א מחובר
                        א.מ.ד.
                        מדריכים
                        כתב נערך לאחרונה על ידי
                        #73

                        @הישבשר-המלומד כתב:

                        @א.מ.ד. בשביל זה אני גם צריך את התוכנה שלך או שאני יכול להריץ לבד,

                        אתה יכול להריץ לבד מודלים קטנים כמו Qwen 3.5 4B (אבל כמו שכתבתי גם ככה תצטרך לחכות לגרסה הבאה של סמארטי), אבל למודלים גדולים כמו Qwen 3.6 35B תצטרך את התוכנה שלי.

                        מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

                        תגובה 1 תגובה אחרונה
                        2
                        • CSS 0C מחובר
                          CSS 0C מחובר
                          CSS 0
                          מדריכים
                          כתב נערך לאחרונה על ידי
                          #74

                          בתאכלס... התוכנה הזו באיזה מודלים תומכת?

                          https://iosii123212-hub.github.io/ani/

                          א.מ.ד.א תגובה 1 תגובה אחרונה
                          0
                          • CSS 0C CSS 0

                            בתאכלס... התוכנה הזו באיזה מודלים תומכת?

                            א.מ.ד.א מחובר
                            א.מ.ד.א מחובר
                            א.מ.ד.
                            מדריכים
                            כתב נערך לאחרונה על ידי
                            #75

                            @CSS-0 כתב:

                            בתאכלס... התוכנה הזו באיזה מודלים תומכת?

                            בכל מודל MoE. הדרישות הן:

                            • שהמודל ייכנס לאחסון
                            • שהחלק המופעל (AxB, לדוגמה ב-Qwen 3.6 35B זה 3B) ייכנס ב-RAM הפנוי

                            מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

                            תגובה 1 תגובה אחרונה
                            2
                            • א.מ.ד.א א.מ.ד.

                              @הישבשר-המלומד כתב:

                              (והאם ביחד עם התוכנה הזאת אני יוכל להריץ את התוכנה שלך (סמרטי) עם מודל אופליין גדול)?

                              כן! כמובן באיטיות, אבל אם אין לך כרגע אינטרנט ואתה רוצה בכל זאת להשתמש בסמארטי, זה יכול להיות שימושי!
                              אבל כדאי שתחכה לגרסה הבאה של סמארטי, שחוסכת משמעותית בטוקנים (הצלחתי לצמצם את הנחיית המערכת לשאילתא בסיסית מכ-23,000 טוקנים לכ-5,000 טוקנים!), מה שאומר שהעיבוד יהיה מהיר בהרבה, וכוללת עוד התאמות להאצת העיבוד, והיא תכלול התאמה מיוחדת למודלים מקומיים שתצמצם עוד יותר את הנחיית המערכת ותסיר חלקים פחות חשובים.
                              לדוגמה מקודם השתמשתי בסמארטי עם Qwen 3.5 4B כדי לבדוק מזג אוויר, ותוך 2-3 דקות המשימה בוצעה בהצלחה (בעברית!).
                              72b67f0f-1bf8-4b59-85e5-86559e1c47d9-image.jpeg

                              ה מנותק
                              ה מנותק
                              החכם השלם
                              כתב נערך לאחרונה על ידי
                              #76

                              @א.מ.ד. יצא לי להשתמש בתוכנה שלך, יותר נכון עברתי לתוכנה שלך מאולמה, הוא מגיב פי 1000 יותר מהר, באולמה הוא היה חושב בין דקה לשלוש דקות לפני שהוא מתחיל לענות!!!
                              (אני עם I7 דור 11 16 ראם) אשמח לדעת איזה מודל יתאים לדעתך.
                              וכן אשמח לדעת מה רמת ההזיות (נראלי מכונה 'טמפרטורה') שהגדרת לו?

                              המלאךה א.מ.ד.א 2 תגובות תגובה אחרונה
                              0
                              • ה החכם השלם

                                @א.מ.ד. יצא לי להשתמש בתוכנה שלך, יותר נכון עברתי לתוכנה שלך מאולמה, הוא מגיב פי 1000 יותר מהר, באולמה הוא היה חושב בין דקה לשלוש דקות לפני שהוא מתחיל לענות!!!
                                (אני עם I7 דור 11 16 ראם) אשמח לדעת איזה מודל יתאים לדעתך.
                                וכן אשמח לדעת מה רמת ההזיות (נראלי מכונה 'טמפרטורה') שהגדרת לו?

                                המלאךה מנותק
                                המלאךה מנותק
                                המלאך
                                כתב נערך לאחרונה על ידי המלאך
                                #77

                                @החכם-השלם כתב:

                                יצא לי להשתמש בתוכנה שלך, יותר נכון עברתי לתוכנה שלך מאולמה, הוא מגיב פי 1000 יותר מהר, באולמה הוא היה חושב בין דקה לשלוש דקות לפני שהוא מתחיל לענות!!!

                                @החכם-השלם זה לא הגיוני.

                                יש לך nvmi?

                                "Code shapes logic, AI expands vision."

                                א.מ.ד.א תגובה 1 תגובה אחרונה
                                0
                                • ה החכם השלם

                                  @א.מ.ד. יצא לי להשתמש בתוכנה שלך, יותר נכון עברתי לתוכנה שלך מאולמה, הוא מגיב פי 1000 יותר מהר, באולמה הוא היה חושב בין דקה לשלוש דקות לפני שהוא מתחיל לענות!!!
                                  (אני עם I7 דור 11 16 ראם) אשמח לדעת איזה מודל יתאים לדעתך.
                                  וכן אשמח לדעת מה רמת ההזיות (נראלי מכונה 'טמפרטורה') שהגדרת לו?

                                  א.מ.ד.א מחובר
                                  א.מ.ד.א מחובר
                                  א.מ.ד.
                                  מדריכים
                                  כתב נערך לאחרונה על ידי
                                  #78

                                  @החכם-השלם כתב:

                                  (אני עם I7 דור 11 16 ראם) אשמח לדעת איזה מודל יתאים לדעתך.

                                  המודלים המומלצים שבפוסט הראשי.

                                  @החכם-השלם כתב:

                                  וכן אשמח לדעת מה רמת ההזיות (נראלי מכונה 'טמפרטורה') שהגדרת לו?

                                  זה מוגדר אוטומטית אני חושב בהתאם למודל, אבל אתה יכול להגדיר את זה כרצונך בהגדרות.

                                  מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

                                  ה תגובה 1 תגובה אחרונה
                                  1
                                  • א.מ.ד.א א.מ.ד.

                                    @החכם-השלם כתב:

                                    (אני עם I7 דור 11 16 ראם) אשמח לדעת איזה מודל יתאים לדעתך.

                                    המודלים המומלצים שבפוסט הראשי.

                                    @החכם-השלם כתב:

                                    וכן אשמח לדעת מה רמת ההזיות (נראלי מכונה 'טמפרטורה') שהגדרת לו?

                                    זה מוגדר אוטומטית אני חושב בהתאם למודל, אבל אתה יכול להגדיר את זה כרצונך בהגדרות.

                                    ה מנותק
                                    ה מנותק
                                    החכם השלם
                                    כתב נערך לאחרונה על ידי
                                    #79

                                    @א.מ.ד.

                                    @א.מ.ד. כתב:

                                    -Gemma 4 26B A4B,

                                    זה?

                                    א.מ.ד.א תגובה 1 תגובה אחרונה
                                    0
                                    • המלאךה המלאך

                                      @החכם-השלם כתב:

                                      יצא לי להשתמש בתוכנה שלך, יותר נכון עברתי לתוכנה שלך מאולמה, הוא מגיב פי 1000 יותר מהר, באולמה הוא היה חושב בין דקה לשלוש דקות לפני שהוא מתחיל לענות!!!

                                      @החכם-השלם זה לא הגיוני.

                                      יש לך nvmi?

                                      א.מ.ד.א מחובר
                                      א.מ.ד.א מחובר
                                      א.מ.ד.
                                      מדריכים
                                      כתב נערך לאחרונה על ידי א.מ.ד.
                                      #80

                                      @המלאך כתב:

                                      @החכם-השלם זה לא הגיוני.

                                      זה הגיוני כי זה llama.cpp המקורי ולא Ollama שמתלבש עליו. כמובן לא פי אלף אבל כן יותר מהיר (במודלים רגילים כמובן, לא במודלי MoE שבעיקר עבורם נועדה התוכנה).

                                      מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

                                      המלאךה תגובה 1 תגובה אחרונה
                                      0
                                      • ה החכם השלם

                                        @א.מ.ד.

                                        @א.מ.ד. כתב:

                                        -Gemma 4 26B A4B,

                                        זה?

                                        א.מ.ד.א מחובר
                                        א.מ.ד.א מחובר
                                        א.מ.ד.
                                        מדריכים
                                        כתב נערך לאחרונה על ידי
                                        #81

                                        @החכם-השלם כתב:

                                        זה?

                                        שניהם. כל אחד למטרה אחרת כפי שכבר פירטתי פה לא פעם ולא פעמיים.

                                        מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

                                        תגובה 1 תגובה אחרונה
                                        0
                                        • א.מ.ד.א א.מ.ד.

                                          @המלאך כתב:

                                          @החכם-השלם זה לא הגיוני.

                                          זה הגיוני כי זה llama.cpp המקורי ולא Ollama שמתלבש עליו. כמובן לא פי אלף אבל כן יותר מהיר (במודלים רגילים כמובן, לא במודלי MoE שבעיקר עבורם נועדה התוכנה).

                                          המלאךה מנותק
                                          המלאךה מנותק
                                          המלאך
                                          כתב נערך לאחרונה על ידי
                                          #82

                                          @א.מ.ד. זה אמור להאט באחוזים נמוכים, אלא אם הvram שלו נמוך..

                                          "Code shapes logic, AI expands vision."

                                          תגובה 1 תגובה אחרונה
                                          0

                                          שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.

                                          נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.

                                          בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗

                                          הרשמה התחברות

                                          • התחברות

                                          • אין לך חשבון עדיין? הרשמה

                                          • התחברו או הירשמו כדי לחפש.
                                          • פוסט ראשון
                                            פוסט אחרון
                                          0
                                          • חוקי הפורום
                                          • פופולרי
                                          • לא נפתר
                                          • משתמשים
                                          • חיפוש גוגל בפורום
                                          • צור קשר