GPT
M

lmstudio-community/Meta-Llama-3-8B-Instruct-GGUF

קוד פתוח

lmstudio-communityllama32024-04-18

  • gguf
  • facebook
  • meta
  • pytorch
  • llama

גרסת GGUF מכווצת של לאמה 3 הקטן מיועדת להרצה מקומית ומהירה על מחשב אישי. היא עוקבת באדיקות אחרי הנחיות ומציגה ביצועים שגוברים על הדור הקודם הגדול ממנה בהרבה.

  • 27.5 GBמשקל הקבצים
  • 7,415הורדות בחודש
  • 193לייקים

מה זה

מדובר בהמרה של דגם שמונה מיליארד הפרמטרים מבית מטא לפורמט שמתאים לתוכנות כמו LM Studio או llama.cpp. הדגם אומן על מעל חמישה עשר טריליון טוקנים, כולל פי ארבעה יותר קוד מלאמה 2, ועבר כוונון הנחיות שמשלב כמה שיטות אופטימיזציה כדי להבטיח היענות מדויקת לפקודות.

לפי נתוני היצרן, הדגם הקטן הזה עוקף את הביצועים של לאמה 2 בגרסת שבעים מיליארד פרמטרים. המשמעות בפועל היא יכולת ניתוח טקסט, כתיבת קוד וניהול שיחה ברמה שהצריכה בעבר שרתים כבדים, כשהפעם אפשר להסתפק בחומרה שולחנית רגילה ולקבל זמני תגובה קצרים בהרבה בזכות מנגנון חלוקת קשב יעיל.

מתאים ל

  • עוזר פיתוח מקומי

    אימון על פי ארבעה יותר קוד מאפשר לו לסייע בכתיבת פונקציות ופתרון באגים ישירות בסביבת הפיתוח.

  • בוט שיחה במחשב אישי

    הוא נצמד היטב לפקודות מערכת מותאמות אישית ומנהל שיחות מרובות שלבים בלי לשלוח מידע החוצה.

  • מענה על שאלות ידע

    מאגר הנתונים העצום שלו מספק תשובות עובדתיות מפורטות במגוון נושאים כלליים באנגלית.

איפה זה נופל

למרות האימון הרחב, הדגם מוגדר רשמית לדוברי אנגלית בלבד. אם תפנו אליו בעברית אתם עלולים לקבל שיבושים או חוסר דיוקים ניכרים בהבנה. בנוסף, מפתחי ההפצה מזהירים בפירוש שהדגם עלול לייצר תוכן פוגעני, מטעה או שגוי לחלוטין, ולכן לא מומלץ להסתמך עליו בעיניים עצומות במערכות קריטיות.

אותה משפחה

Meta-Llama-3 יצא ב־3 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם צריך להוריד את כל עשרת הקבצים שבמאגר?

לא, מורידים רק קובץ אחד שמתאים למידת הכיווץ הרצויה ולמגבלות הזיכרון של המחשב שלכם. הנפח הכולל של עשרים ושבעה ג'יגה מייצג את כל האפשרויות יחד.

איך דואגים שהדגם יגיב בדיוק לפי ההנחיות?

הדגם פותח כך שיתייחס ברצינות רבה להוראות המערכת. שימוש במבנה הפרומפט המדויק של לאמה 3 מבטיח שהוא יישמע להגדרות התפקיד שתקבעו לו.

איך מריצים

את הדגם הזה מורידים ישירות דרך LM Studio או מריצים עצמאית עם llama.cpp על המחשב. המאגר מכיל עשרה קבצים שונים בנפח כולל של מעל עשרים ושבעה ג'יגה, שכוללים רמות כיווץ מגוונות שנוצרו בעזרת מטריצת חשיבות ייעודית, כך שבוחרים קובץ יחיד שמתאים לגודל הזיכרון הפנוי שלכם.

אין צורך במערך כרטיסי מסך יקר כדי להתחיל לעבוד איתו, ומחשב עם זיכרון גרפי סביר מריץ קובץ מכווץ בודד ללא מאמץ. אם אתם זקוקים למענה מקביל למאות משתמשים בו זמנית, עדיף לפנות לשירות מרוחק במקום לנהל את החומרה לבד.

ollama run hf.co/lmstudio-community/Meta-Llama-3-8B-Instruct-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

השימוש כפוף לרישיון הרשמי של לאמה 3 מבית מטא. הרישיון מאפשר שימוש מסחרי, אך כולל מגבלות הפצה ותנאים מחייבים שמפורטים בהסכם המקורי, במיוחד עבור חברות שמשרתות היקפי משתמשים עצומים.

  • שימוש מסחרי עד 700 מיליון משתמשים
  • שינוי הקוד
  • חובת ייחוס

הרישיון המלא בעמוד המודל ↗