מדריך | מודלי AI מקומיים - מדריך וסקירה מקיפים - עדכון כ"ח אב ה'תשפ"ו
-
עבור חומרה עם 16 RAM: לצרכי קידוד חכמים - בעיקרון המודל המומלץ הוא Qwen 3.5 9B או הגרסה המכווננת שלו OmniCoder 9B, אבל מדובר במודלים יחסית כבדים לחומרה כזאת שמצריכים סגירה של שאר התוכנות, ולכן מומלץ להשתמש לקידוד ב-Qwen 3.5 4B או בגרסה המכווננת שלו Qwopus 3.5 4B. לשימוש כללי - Gemma 4 E4B. אם קיים GPU חזק, ניתן להעביר כמה שיותר שכבות ל-GPU לעיבוד מהיר בהרבה.
עבור חומרה עם 8 RAM: עבור קידוד מומלץ להשתמש ב-Qwen 3.5 4B או בגרסה המכווננת שלו Qwopus 3.5 4B. לשימוש כללי - Gemma 4 E2B.
@א.מ.ד. זה עדיין בתוקף או שיש מודלים מתקדמים יותר?
-
ח חובבן מקצועי התייחס לנושא זה
-
א א.מ.ד. התייחס לנושא זה
-
א א.מ.ד. התייחס לנושא זה
-
המדריך עודכן - כ"ח באב ה'תשפ"ו, כולל הוספות רבות, קישורים לכל המודלים והכלים, ועדכון תמונת המצב.
-
@עידו300 האמת שאני עצמי לא ממש זוכר, התחלתי לעדכן ממש מזמן... בעיקר NPU, עדכון המודלים, וקישורים למודלים והכלים. זה מה שאני זוכר מהזמן האחרון.
-
זה שלושת השלבים: (אם אתה בנטפרי, ממליץ לך להתייאש..)


(בנוגע לבחירה בתמונה הזו - זו סתם הייתה בחירה רנדומלית בקבצים להורדה, תוריך את הקוונטיזציה לפי הצורך שלך..)
-
אם אדם צריך כלי עבודה עם מענה מהיר, למה צריך דוקא מודל מעודכן? מה רע במודל ישן שיוכל לעבוד על חומרה חלשה? אם לדוגמא אני צריך רק מודל שידע לענות למיילים (RAG) ולהשתמש בAPI מתועד, למה אני צריך מודל חזק?
אם אדם צריך כלי עבודה עם מענה מהיר, למה צריך דוקא מודל מעודכן? מה רע במודל ישן שיוכל לעבוד על חומרה חלשה? אם לדוגמא אני צריך רק מודל שידע לענות למיילים (RAG) ולהשתמש בAPI מתועד, למה אני צריך מודל חזק?
מעודכן לא הכוונה רק מעודכן בידע, אלא שהוא חזק ואיכותי יותר, מה שמאפשר לך שימוש יותר יציב ואמין באותו גודל, או לעבור למודל קטן יותר ולהישאר באותה איכות.
שלום! נראה שהשיחה הזו מעניינת אותך, אבל עדיין אין לך חשבון.
נמאס לכם לגלול בין אותם הפוסטים בכל ביקור? כשנרשמים לחשבון, תמיד תחזרו בדיוק למקום שבו הייתם קודם, ותוכלו לבחור לקבל התראות על תגובות חדשות (בין אם במייל, ובין אם בהתראת פוש). תוכלו גם לשמור סימניות ולפרגן ב-upvote לפוסטים כדי להביע הערכה לחברי קהילה אחרים.
בעזרת התרומה שלך, הפוסט הזה יכול להיות אפילו טוב יותר 💗
הרשמה התחברות