דילוג לתוכן
  • חוקי הפורום
  • פופולרי
  • לא נפתר
  • משתמשים
  • חיפוש גוגל בפורום
  • צור קשר
עיצובים
  • בהיר
  • Brite
  • Cerulean
  • Cosmo
  • Flatly
  • Journal
  • Litera
  • Lumen
  • Lux
  • Materia
  • Minty
  • Morph
  • Pulse
  • Sandstone
  • Simplex
  • Sketchy
  • Spacelab
  • United
  • Yeti
  • Zephyr
  • כהה
  • Cyborg
  • Darkly
  • Quartz
  • Slate
  • Solar
  • Superhero
  • Vapor

  • ברירת מחדל (ללא עיצוב (ברירת מחדל))
  • ללא עיצוב (ברירת מחדל)
כיווץ
מתמחים טופ
  1. דף הבית
  2. קטגוריות בהרצה
  3. תכנות
  4. בינה מלאכותית - AI
  5. עזרה הדדית - בינה מלאכותית
  6. SparkMoE - מערכת להרצת מודלי AI גדולים ועוצמתיים באופן מקומי על חומרה חלשה, עדכון - גרסה V0.3.0!

SparkMoE - מערכת להרצת מודלי AI גדולים ועוצמתיים באופן מקומי על חומרה חלשה, עדכון - גרסה V0.3.0!

מתוזמן נעוץ נעול הועבר עזרה הדדית - בינה מלאכותית
112 פוסטים 20 כותבים 1.7k צפיות 26 עוקבים
  • מהישן לחדש
  • מהחדש לישן
  • הכי הרבה הצבעות
תגובה
  • תגובה כנושא
התחברו כדי לפרסם תגובה
נושא זה נמחק. רק משתמשים עם הרשאות מתאימות יוכלו לצפות בו.
  • ה החכם השלם

    @א.מ.ד.

    @א.מ.ד. כתב:

    -Gemma 4 26B A4B,

    זה?

    א.מ.ד.א מחובר
    א.מ.ד.א מחובר
    א.מ.ד.
    מדריכים
    כתב נערך לאחרונה על ידי
    #81

    @החכם-השלם כתב:

    זה?

    שניהם. כל אחד למטרה אחרת כפי שכבר פירטתי פה לא פעם ולא פעמיים.

    מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

    תגובה 1 תגובה אחרונה
    0
    • א.מ.ד.א א.מ.ד.

      @המלאך כתב:

      @החכם-השלם זה לא הגיוני.

      זה הגיוני כי זה llama.cpp המקורי ולא Ollama שמתלבש עליו. כמובן לא פי אלף אבל כן יותר מהיר (במודלים רגילים כמובן, לא במודלי MoE שבעיקר עבורם נועדה התוכנה).

      המלאךה מנותק
      המלאךה מנותק
      המלאך
      כתב נערך לאחרונה על ידי
      #82

      @א.מ.ד. זה אמור להאט באחוזים נמוכים, אלא אם הvram שלו נמוך..

      תגובה 1 תגובה אחרונה
      0
      • א.מ.ד.א א.מ.ד.

        SparkMoE

        SparkMoE.png

        בהשראת הפרויקט שהוזכר כאן ע"י @המלאך - בשם colibri, שבו קבוצת חוקרים הצליחו להריץ את המודל העוצמתי GLM 5.2 על חומרה ביתית, עם כמה עשרות GB RAM "בלבד" (לצורך ההרצה נטו נצרכו כ-25 RAM), החלטתי ליצור פרויקט דומה אך שונה, שיתאים לחומרה חלשה באמת ויריץ מודלי MoE בגודל בינוני, כמו Qwen 3.6 35B A3B ו-Gemma 4 26B A4B, במכשירים עם 8/16 GB RAM (לא נבדק על 8 RAM, אבל אמור לעבוד באותה מידה).
        לכאורה זה אמור להתאים גם להרצת מודלי MoE גדולים מאוד של מאות B פרמטרים על חומרה בינונית (32 GB RAM ומעלה), אבל לצערי אין לי חומרה כזו כך שאין לי איך לנסות אם זה באמת עובד...

        הרעיון המרכזי שעומד מאחורי הפרויקט הוא השארת המודל המלא על ה-SSD (כונן האחסון), וטעינת ופריקת מומחי ה-MoE באופן דינמי ל-RAM לפי הצורך. זה מאפשר הרצת מודלים בינוניים (20-40B פרמטרים) על גבי מכשירים עם RAM צרכני קלאסי, אף ללא GPU, מכיון שלא מתבצעת טעינה מלאה של כלל המודל ל-RAM.

        כרגע הצלחתי להגיע ב-SparkMoE במודל Qwen 3.6 35B A3B עם MTP מופעל לבערך 4 טוקנים לשניה - איטי אבל שמיש. בגרסאות הבאות בעז"ה אני אנסה להאיץ ככל האפשר את ההסקה.
        המהירות תלויה במהירות הקריאה מה-SSD, מספר ליבות ושרשורי מעבד, רוחב פס ועוד, לכן במחשב שמצטיין באלה ההסקה תהיה מהירה יותר.

        שימו לב: בהרצה הראשונה של המודל לאחר הפעלת השרת המקומי, ההסקה איטית יותר, אך עם התקדמות היצירה ההסקה מאיצה, בשל כך שחלק מהמומחים שכבר היו בשימוש כבר נמצאים במטמון המהיר יותר מה-SSD.

        SparkMoE תומך בכל הפונקציונליות הקיימת של פרוייקט llama.cpp המקורי, כמו MTP, שרת OpenAI מקומי ועוד.
        כמו כן, SparkMoE תומך גם במודלים צפופים רגילים, לא רק במודלי MoE, אבל במודלים רגילים ההסקה היא רק בגודל מודל סטנדרטי.

        אופן ההרצה:

        כדי להריץ מודל גדול עם SparkMoE, יש להפעיל את התוכנה, ובממשק הדשבורד המופיע בדפדפן יש לבחור (בהפעלה הראשונה) בתיקיית מודלים (גם תתי-תיקיות נתמכות, כך שאפשר להשתמש בתיקיית Models של LM Studio), לבחור מודל, ואז ללחוץ על "הפעל מודל". להמתין לטעינת המודל עד שכפתור "פתיחת הצ'אט" נהיה זמין.
        בלחיצה על "פתיחת הצ'אט", ייפתח בכרטיסיה חדשה בדפדפן ממשק הצ'אט של SparkMoE.
        בממשק הצ'אט ניתן לשנות הגדרות רבות, כמו MTP, הודעת מערכת, פרמטרי הסקה ועוד, בלשונית "הגדרות". ניתן גם להגדיר רמת חשיבה.


        תמונות לדוגמה:

        ניהול השרת:
        6d7ef604-32e0-4b68-8f6c-773ccdb6559b-image.jpeg

        ממשק הצ'אט והגדרות ההסקה:
        f5f0944b-c2e3-4392-a1b9-f21faeea4b72-image.jpeg


        מודלים תואמים מומלצים:

        כרגע עדיין אסור ע"פ חוקי הפורום להעלות מודלי AI באופן ישיר בשל "פריצת סינונים", אבל מצורפים כמה קישורים עבור מודלי MoE בגודל בינוני, במידה והם פתוחים בסינון המותקן אצלכם:

        • Qwen 3.6 35B A3B MTP
        • Gemma 4 26B A4B

        מומלץ להוריד את קוונטיזציית Q4 של כל מודל, או IQ4 אם קיים.
        אם החומרה שברשותכם בעלת 32 GB RAM ומעלה, אפשר להתקדם למודלי MoE גדולים יותר.

        עדכונים:

        • עדכון V0.3.0:
          תוקנה תמיכה במודל Gemma 4 26B, שיפורי מהירות בכלל מודלי MoE, ותיקוני באגים.

        הורדה:

        הפרוייקט זמין בקוד פתוח בגיטהאב, ראו כאן.
        ניתן להוריד קובץ EXE להתקנה מהירה מה-releases, או גרסת ZIP ניידת (לחלץ לתיקיה ולהפעיל את SparkMoE.exe).
        אל תשכחו לשים ⭐ במאגר בגיטהאב על הדרך!
        (הקוד המקורי של llama.cpp ברישיון MIT, והחלקים שלי תחת רישיון לא מסחרי).


        אשמח לשמוע על המהירות והביצועים של המודלים השונים על חומרות שונות, וכן לקבל משוב על התוכנה עצמה!

        1 מנותק
        1 מנותק
        123 דג מלוח
        כתב נערך לאחרונה על ידי 123 דג מלוח
        #83

        @א.מ.ד. למה כשאני פותח את זה מSparkMoE.exe זה נפתח (מלבד התוכנה באמצעות הדפדפן) גם חלון קונסול.
        וכשביקשתי מסמארטי שיפתח את זה הוא פתח ולא נפתח הקונסול.
        זה אני טיפש או שהוא חכם?
        וא"כ אפשר אולי לעשות פאואר של שפותח את זה בלי הקונסול?

        המלאךה א.מ.ד.א 2 תגובות תגובה אחרונה
        0
        • 1 123 דג מלוח

          @א.מ.ד. למה כשאני פותח את זה מSparkMoE.exe זה נפתח (מלבד התוכנה באמצעות הדפדפן) גם חלון קונסול.
          וכשביקשתי מסמארטי שיפתח את זה הוא פתח ולא נפתח הקונסול.
          זה אני טיפש או שהוא חכם?
          וא"כ אפשר אולי לעשות פאואר של שפותח את זה בלי הקונסול?

          המלאךה מנותק
          המלאךה מנותק
          המלאך
          כתב נערך לאחרונה על ידי
          #84
          פוסט זה נמחק!
          תגובה 1 תגובה אחרונה
          0
          • 1 123 דג מלוח

            @א.מ.ד. למה כשאני פותח את זה מSparkMoE.exe זה נפתח (מלבד התוכנה באמצעות הדפדפן) גם חלון קונסול.
            וכשביקשתי מסמארטי שיפתח את זה הוא פתח ולא נפתח הקונסול.
            זה אני טיפש או שהוא חכם?
            וא"כ אפשר אולי לעשות פאואר של שפותח את זה בלי הקונסול?

            א.מ.ד.א מחובר
            א.מ.ד.א מחובר
            א.מ.ד.
            מדריכים
            כתב נערך לאחרונה על ידי א.מ.ד.
            #85

            @123-דג-מלוח כתב:

            @א.מ.ד. למה כשאני פותח את זה מSparkMoE.exe זה נפתח (מלבד התוכנה באמצעות הדפדפן) גם חלון קונסול.
            וכשביקשתי מסמארטי שיפתח את זה הוא פתח ולא נפתח הקונסול.
            זה אני טיפש או שהוא חכם?
            וא"כ אפשר אולי לעשות פאואר של שפותח את זה בלי הקונסול?

            אפשר לפתוח ברקע, אבל כרגע זה בכוונה פותח קונסול כדי לנפות שגיאות. בעז"ה בגרסה הבאה הכל כבר יהיה כלול בתוך ממשק הצ'אט, ולא יהיה חלון קונסול, ולא יהיה ממשק בקרה בדפדפן, אלא הכל בתוך הממשק היפה של הצ'אט.

            מפתח אפליקציות אנדרואיד ויישומי ומודלי AI

            תגובה 1 תגובה אחרונה
            0
            • א.מ.ד.א א.מ.ד.

              SparkMoE

              SparkMoE.png

              בהשראת הפרויקט שהוזכר כאן ע"י @המלאך - בשם colibri, שבו קבוצת חוקרים הצליחו להריץ את המודל העוצמתי GLM 5.2 על חומרה ביתית, עם כמה עשרות GB RAM "בלבד" (לצורך ההרצה נטו נצרכו כ-25 RAM), החלטתי ליצור פרויקט דומה אך שונה, שיתאים לחומרה חלשה באמת ויריץ מודלי MoE בגודל בינוני, כמו Qwen 3.6 35B A3B ו-Gemma 4 26B A4B, במכשירים עם 8/16 GB RAM (לא נבדק על 8 RAM, אבל אמור לעבוד באותה מידה).
              לכאורה זה אמור להתאים גם להרצת מודלי MoE גדולים מאוד של מאות B פרמטרים על חומרה בינונית (32 GB RAM ומעלה), אבל לצערי אין לי חומרה כזו כך שאין לי איך לנסות אם זה באמת עובד...

              הרעיון המרכזי שעומד מאחורי הפרויקט הוא השארת המודל המלא על ה-SSD (כונן האחסון), וטעינת ופריקת מומחי ה-MoE באופן דינמי ל-RAM לפי הצורך. זה מאפשר הרצת מודלים בינוניים (20-40B פרמטרים) על גבי מכשירים עם RAM צרכני קלאסי, אף ללא GPU, מכיון שלא מתבצעת טעינה מלאה של כלל המודל ל-RAM.

              כרגע הצלחתי להגיע ב-SparkMoE במודל Qwen 3.6 35B A3B עם MTP מופעל לבערך 4 טוקנים לשניה - איטי אבל שמיש. בגרסאות הבאות בעז"ה אני אנסה להאיץ ככל האפשר את ההסקה.
              המהירות תלויה במהירות הקריאה מה-SSD, מספר ליבות ושרשורי מעבד, רוחב פס ועוד, לכן במחשב שמצטיין באלה ההסקה תהיה מהירה יותר.

              שימו לב: בהרצה הראשונה של המודל לאחר הפעלת השרת המקומי, ההסקה איטית יותר, אך עם התקדמות היצירה ההסקה מאיצה, בשל כך שחלק מהמומחים שכבר היו בשימוש כבר נמצאים במטמון המהיר יותר מה-SSD.

              SparkMoE תומך בכל הפונקציונליות הקיימת של פרוייקט llama.cpp המקורי, כמו MTP, שרת OpenAI מקומי ועוד.
              כמו כן, SparkMoE תומך גם במודלים צפופים רגילים, לא רק במודלי MoE, אבל במודלים רגילים ההסקה היא רק בגודל מודל סטנדרטי.

              אופן ההרצה:

              כדי להריץ מודל גדול עם SparkMoE, יש להפעיל את התוכנה, ובממשק הדשבורד המופיע בדפדפן יש לבחור (בהפעלה הראשונה) בתיקיית מודלים (גם תתי-תיקיות נתמכות, כך שאפשר להשתמש בתיקיית Models של LM Studio), לבחור מודל, ואז ללחוץ על "הפעל מודל". להמתין לטעינת המודל עד שכפתור "פתיחת הצ'אט" נהיה זמין.
              בלחיצה על "פתיחת הצ'אט", ייפתח בכרטיסיה חדשה בדפדפן ממשק הצ'אט של SparkMoE.
              בממשק הצ'אט ניתן לשנות הגדרות רבות, כמו MTP, הודעת מערכת, פרמטרי הסקה ועוד, בלשונית "הגדרות". ניתן גם להגדיר רמת חשיבה.


              תמונות לדוגמה:

              ניהול השרת:
              6d7ef604-32e0-4b68-8f6c-773ccdb6559b-image.jpeg

              ממשק הצ'אט והגדרות ההסקה:
              f5f0944b-c2e3-4392-a1b9-f21faeea4b72-image.jpeg


              מודלים תואמים מומלצים:

              כרגע עדיין אסור ע"פ חוקי הפורום להעלות מודלי AI באופן ישיר בשל "פריצת סינונים", אבל מצורפים כמה קישורים עבור מודלי MoE בגודל בינוני, במידה והם פתוחים בסינון המותקן אצלכם:

              • Qwen 3.6 35B A3B MTP
              • Gemma 4 26B A4B

              מומלץ להוריד את קוונטיזציית Q4 של כל מודל, או IQ4 אם קיים.
              אם החומרה שברשותכם בעלת 32 GB RAM ומעלה, אפשר להתקדם למודלי MoE גדולים יותר.

              עדכונים:

              • עדכון V0.3.0:
                תוקנה תמיכה במודל Gemma 4 26B, שיפורי מהירות בכלל מודלי MoE, ותיקוני באגים.

              הורדה:

              הפרוייקט זמין בקוד פתוח בגיטהאב, ראו כאן.
              ניתן להוריד קובץ EXE להתקנה מהירה מה-releases, או גרסת ZIP ניידת (לחלץ לתיקיה ולהפעיל את SparkMoE.exe).
              אל תשכחו לשים ⭐ במאגר בגיטהאב על הדרך!
              (הקוד המקורי של llama.cpp ברישיון MIT, והחלקים שלי תחת רישיון לא מסחרי).


              אשמח לשמוע על המהירות והביצועים של המודלים השונים על חומרות שונות, וכן לקבל משוב על התוכנה עצמה!

              CSS 0C מחובר
              CSS 0C מחובר
              CSS 0
              מדריכים
              כתב נערך לאחרונה על ידי
              #86

              @א.מ.ד. א' - שניסיתי להפעיל פשוט קרס לי המחשב (ועם מודל באיכות של q2 של Gemma 4 26B A4B והמחשב קרס עם 8RAM (וזה מחשב שדי עומד בביצועים) כולו בהתחלה האט, וגם היה שגיאה ופעם השניה שניסיתי להפעיל הוא קרס...)

              https://iosii123212-hub.github.io/ani/

              המלאךה תגובה 1 תגובה אחרונה
              0
              • CSS 0C CSS 0

                @א.מ.ד. א' - שניסיתי להפעיל פשוט קרס לי המחשב (ועם מודל באיכות של q2 של Gemma 4 26B A4B והמחשב קרס עם 8RAM (וזה מחשב שדי עומד בביצועים) כולו בהתחלה האט, וגם היה שגיאה ופעם השניה שניסיתי להפעיל הוא קרס...)

                המלאךה מנותק
                המלאךה מנותק
                המלאך
                כתב נערך לאחרונה על ידי
                #87

                @CSS-0 כי הראם זה לא הבעיה, אלא הSSD, כמה מקום יש לך בSSD והאם זה NVMI ?

                או שזה בכלל HDD..

                CSS 0C תגובה 1 תגובה אחרונה
                1
                • המלאךה המלאך

                  @CSS-0 כי הראם זה לא הבעיה, אלא הSSD, כמה מקום יש לך בSSD והאם זה NVMI ?

                  או שזה בכלל HDD..

                  CSS 0C מחובר
                  CSS 0C מחובר
                  CSS 0
                  מדריכים
                  כתב נערך לאחרונה על ידי
                  #88

                  @המלאך ב SSD יש לי פנוי 20GB. והמודל שוקל 10GB ..

                  https://iosii123212-hub.github.io/ani/

                  המלאךה תגובה 1 תגובה אחרונה
                  0
                  • CSS 0C CSS 0

                    @המלאך ב SSD יש לי פנוי 20GB. והמודל שוקל 10GB ..

                    המלאךה מנותק
                    המלאךה מנותק
                    המלאך
                    כתב נערך לאחרונה על ידי
                    #89

                    @CSS-0 יש לך SSD nvmi או לא?

                    CSS 0C תגובה 1 תגובה אחרונה
                    1
                    • המלאךה המלאך

                      @CSS-0 יש לך SSD nvmi או לא?

                      CSS 0C מחובר
                      CSS 0C מחובר
                      CSS 0
                      מדריכים
                      כתב נערך לאחרונה על ידי
                      #90

                      @המלאך פרוש?

                      https://iosii123212-hub.github.io/ani/

                      המלאךה תגובה 1 תגובה אחרונה
                      0
                      • CSS 0C CSS 0

                        @המלאך פרוש?

                        המלאךה מנותק
                        המלאךה מנותק
                        המלאך
                        כתב נערך לאחרונה על ידי
                        #91

                        @CSS-0 סוג כונן/העברת נתונים.

                        שאל את GPT..

                        CSS 0C תגובה 1 תגובה אחרונה
                        1
                        • המלאךה המלאך

                          @CSS-0 סוג כונן/העברת נתונים.

                          שאל את GPT..

                          CSS 0C מחובר
                          CSS 0C מחובר
                          CSS 0
                          מדריכים
                          כתב נערך לאחרונה על ידי
                          #92

                          @המלאך לא זה לא , זה SATA.

                          https://iosii123212-hub.github.io/ani/

                          המלאךה תגובה 1 תגובה אחרונה
                          0
                          • CSS 0C CSS 0

                            @המלאך לא זה לא , זה SATA.

                            המלאךה מנותק
                            המלאךה מנותק
                            המלאך
                            כתב נערך לאחרונה על ידי
                            #93

                            @CSS-0 מעניין, מצד שני יש פה כאלה שזה כן עובד להם,

                            לא יודע..

                            CSS 0C תגובה 1 תגובה אחרונה
                            1
                            • המלאךה המלאך

                              @CSS-0 מעניין, מצד שני יש פה כאלה שזה כן עובד להם,

                              לא יודע..

                              CSS 0C מחובר
                              CSS 0C מחובר
                              CSS 0
                              מדריכים
                              כתב נערך לאחרונה על ידי
                              #94

                              @המלאך כתב:

                              לא הבנתי זה שזה SATA זה טוב או לא?

                              https://iosii123212-hub.github.io/ani/

                              המלאךה ה 2 תגובות תגובה אחרונה
                              0
                              • CSS 0C CSS 0

                                @המלאך כתב:

                                לא הבנתי זה שזה SATA זה טוב או לא?

                                המלאךה מנותק
                                המלאךה מנותק
                                המלאך
                                כתב נערך לאחרונה על ידי המלאך
                                #95

                                @CSS-0 זה נורמלי.

                                גם לי יש.
                                ס"ה היה לי איזשהיא השערה..

                                תגובה 1 תגובה אחרונה
                                1
                                • CSS 0C CSS 0

                                  @המלאך כתב:

                                  לא הבנתי זה שזה SATA זה טוב או לא?

                                  ה מנותק
                                  ה מנותק
                                  החכם השלם
                                  כתב נערך לאחרונה על ידי
                                  #96

                                  @CSS-0 זה פחות חדיש מהNVME אבל גם מגיע למהירויות מטורפות, אולי לא מספיק לAI? אין לי מושג (יצא לי להעביר מNVME לSATA במהירות 700 מ"ב בשניה)

                                  המלאךה תגובה 1 תגובה אחרונה
                                  😲
                                  0
                                  • ה החכם השלם

                                    @CSS-0 זה פחות חדיש מהNVME אבל גם מגיע למהירויות מטורפות, אולי לא מספיק לAI? אין לי מושג (יצא לי להעביר מNVME לSATA במהירות 700 מ"ב בשניה)

                                    המלאךה מנותק
                                    המלאךה מנותק
                                    המלאך
                                    כתב נערך לאחרונה על ידי
                                    #97

                                    @החכם-השלם מה זה 'מספיק'?
                                    גם SSD אמור לעבוד (אלא אם המנגנון העברת נתונים עצמו שונה, אני לא כל כך מבין בזה..) רק שזה יהיה איטי להחריד, כאן זה שונה כי זה קורס..
                                    מסתמא זה בCPU או ראם, אבל מצד שני מודלים מקומיים רגילים בlama.cpp אתה טוען שאתה כן מצליח להריץ..

                                    CSS 0C תגובה 1 תגובה אחרונה
                                    1
                                    • המלאךה המלאך

                                      @החכם-השלם מה זה 'מספיק'?
                                      גם SSD אמור לעבוד (אלא אם המנגנון העברת נתונים עצמו שונה, אני לא כל כך מבין בזה..) רק שזה יהיה איטי להחריד, כאן זה שונה כי זה קורס..
                                      מסתמא זה בCPU או ראם, אבל מצד שני מודלים מקומיים רגילים בlama.cpp אתה טוען שאתה כן מצליח להריץ..

                                      CSS 0C מחובר
                                      CSS 0C מחובר
                                      CSS 0
                                      מדריכים
                                      כתב נערך לאחרונה על ידי
                                      #98

                                      @המלאך זה הלוגים, ותמיד אני מריץ עליו מודלים (אני מפעיל עליו מערכת טלפונית של AI מבוססת על מודל של 8B וזה עובד תקין וחלק בלי להאט לי את המחשב מעולם, המהירות אינטרנט זה 90MB לשניה, והמהירות שזה מחזיר למשתמש את התשובה זה ממוצע של 7 שניות, (וזה כולל המרה של הטקסט שהמודל מחזיר לשמע עם BlueTTS) אז אני לא חושב שאמור להיות בו בעיה...
                                      בכל מקרה זה הלוגים:

                                      0.00.009.579 I cmn  common_param: common_params_print_info: verbosity = 3 (adjust with the `-lv N` CLI arg)
                                      0.00.023.223 I srv    load_model: loading model 'C:\Users\USER\Downloads\gemma-4-26B-A4B-it-UD-IQ2_M.gguf'
                                      0.01.271.513 W common_fit_params: failed to fit params to free device memory: was unable to fit model into system memory by reducing context, abort
                                      0.02.162.598 W load: control-looking token:    212 '</s>' was not control-type; this is probably a bug in the model. its type will be overridden
                                      0.02.165.271 W load: control-looking token:     50 '<|tool_response>' was not control-type; this is probably a bug in the model. its type will be overridden
                                      0.02.177.253 W load: control-looking token:      1 '<eos>' was not control-type; this is probably a bug in the model. its type will be overridden
                                      0.02.215.972 W load: special_eog_ids contains '<|tool_response>', removing '</s>' token from EOG list
                                      1.02.461.952 W cmn  common_init_: KV cache shifting is not supported for this context, disabling KV cache shifting
                                      
                                      

                                      https://iosii123212-hub.github.io/ani/

                                      CSS 0C המלאךה א.מ.ד.א פ 4 תגובות תגובה אחרונה
                                      0
                                      • CSS 0C CSS 0

                                        @המלאך זה הלוגים, ותמיד אני מריץ עליו מודלים (אני מפעיל עליו מערכת טלפונית של AI מבוססת על מודל של 8B וזה עובד תקין וחלק בלי להאט לי את המחשב מעולם, המהירות אינטרנט זה 90MB לשניה, והמהירות שזה מחזיר למשתמש את התשובה זה ממוצע של 7 שניות, (וזה כולל המרה של הטקסט שהמודל מחזיר לשמע עם BlueTTS) אז אני לא חושב שאמור להיות בו בעיה...
                                        בכל מקרה זה הלוגים:

                                        0.00.009.579 I cmn  common_param: common_params_print_info: verbosity = 3 (adjust with the `-lv N` CLI arg)
                                        0.00.023.223 I srv    load_model: loading model 'C:\Users\USER\Downloads\gemma-4-26B-A4B-it-UD-IQ2_M.gguf'
                                        0.01.271.513 W common_fit_params: failed to fit params to free device memory: was unable to fit model into system memory by reducing context, abort
                                        0.02.162.598 W load: control-looking token:    212 '</s>' was not control-type; this is probably a bug in the model. its type will be overridden
                                        0.02.165.271 W load: control-looking token:     50 '<|tool_response>' was not control-type; this is probably a bug in the model. its type will be overridden
                                        0.02.177.253 W load: control-looking token:      1 '<eos>' was not control-type; this is probably a bug in the model. its type will be overridden
                                        0.02.215.972 W load: special_eog_ids contains '<|tool_response>', removing '</s>' token from EOG list
                                        1.02.461.952 W cmn  common_init_: KV cache shifting is not supported for this context, disabling KV cache shifting
                                        
                                        
                                        CSS 0C מחובר
                                        CSS 0C מחובר
                                        CSS 0
                                        מדריכים
                                        כתב נערך לאחרונה על ידי
                                        #99

                                        והפעם זה החזיר את זה בלי להאט את המחשב..

                                        https://iosii123212-hub.github.io/ani/

                                        תגובה 1 תגובה אחרונה
                                        0
                                        • CSS 0C CSS 0

                                          @המלאך זה הלוגים, ותמיד אני מריץ עליו מודלים (אני מפעיל עליו מערכת טלפונית של AI מבוססת על מודל של 8B וזה עובד תקין וחלק בלי להאט לי את המחשב מעולם, המהירות אינטרנט זה 90MB לשניה, והמהירות שזה מחזיר למשתמש את התשובה זה ממוצע של 7 שניות, (וזה כולל המרה של הטקסט שהמודל מחזיר לשמע עם BlueTTS) אז אני לא חושב שאמור להיות בו בעיה...
                                          בכל מקרה זה הלוגים:

                                          0.00.009.579 I cmn  common_param: common_params_print_info: verbosity = 3 (adjust with the `-lv N` CLI arg)
                                          0.00.023.223 I srv    load_model: loading model 'C:\Users\USER\Downloads\gemma-4-26B-A4B-it-UD-IQ2_M.gguf'
                                          0.01.271.513 W common_fit_params: failed to fit params to free device memory: was unable to fit model into system memory by reducing context, abort
                                          0.02.162.598 W load: control-looking token:    212 '</s>' was not control-type; this is probably a bug in the model. its type will be overridden
                                          0.02.165.271 W load: control-looking token:     50 '<|tool_response>' was not control-type; this is probably a bug in the model. its type will be overridden
                                          0.02.177.253 W load: control-looking token:      1 '<eos>' was not control-type; this is probably a bug in the model. its type will be overridden
                                          0.02.215.972 W load: special_eog_ids contains '<|tool_response>', removing '</s>' token from EOG list
                                          1.02.461.952 W cmn  common_init_: KV cache shifting is not supported for this context, disabling KV cache shifting
                                          
                                          
                                          המלאךה מנותק
                                          המלאךה מנותק
                                          המלאך
                                          כתב נערך לאחרונה על ידי המלאך
                                          #100

                                          @CSS-0 תביא ל @א.מ.ד. .
                                          בכל מקרה סתם סקרנות, המחשב שלך מחובר כאילו כל הזמן לחשמל ולאינטרנט?

                                          CSS 0C תגובה 1 תגובה אחרונה
                                          0

                                          שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.

                                          נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.

                                          בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗

                                          הרשמה התחברות

                                          • התחברות

                                          • אין לך חשבון עדיין? הרשמה

                                          • התחברו או הירשמו כדי לחפש.
                                          • פוסט ראשון
                                            פוסט אחרון
                                          0
                                          • חוקי הפורום
                                          • פופולרי
                                          • לא נפתר
                                          • משתמשים
                                          • חיפוש גוגל בפורום
                                          • צור קשר