GPT
T

t5-v1_1-xxl-encoder-gguf

קוד פתוח

city96apache-2.02024-08-19

  • gguf
  • en
  • endpoints_compatible

גרסה מכווצת של המקודד מגוגל בפורמט שמתאים למי שרוצה לחבר אותו ישירות ליצירת תמונות מקומית. הוא פותר את בעיית הזיכרון בלי לשבור את הראש עם הגדרות מסובכות.

  • 52.8 GBמשקל הקבצים
  • 106,532הורדות בחודש
  • 538לייקים

מה זה

מדובר בהמרה של מקודד הטקסט מתוך T5 v1.1 XXL של גוגל לפורמט GGUF, שמיועד בעיקר לשימוש לצד מודלים של יצירת תמונות או להפקת וקטורים. המודל כולל רק את צד המקודד, כך שאי אפשר לייצר איתו טקסט חופשי או לנהל שיחה, אלא רק לתרגם קלט טקסטואלי לייצוג מתמטי.

המשקל הכולל של כלל הגרסאות מגיע ל־52.8 גיגה בייט ומחולק ל־13 קבצים לפי רמות דיוק שונות. הייחוד כאן הוא היכולת לטעון רכיב כבד מאוד מתוך תהליכי עבודה מקומיים כמו ComfyUI בלי להחזיק משאבי ענק שנשמרים למודלים מלאים.

מתאים ל

  • הזנת טקסט למחוללי תמונות

    חיבור קל לתוך ComfyUI לצורך פיענוח הנחיות טקסט מורכבות לפני יצירת תמונה.

  • חילוץ וקטורים בטקסט אנגלי

    הרצה מקומית עם llama-embedding להפקת ייצוגים מתמטיים של משפטים בלי תלות ברשת.

  • עבודה על חומרה ביתית

    הפעלת מקודד ענק של גוגל על כרטיסי מסך רגילים תודות לחיתוך בפורמט GGUF.

איפה זה נופל

זה רק מקודד באנגלית. אם תנסו לתת לו פרומפטים בעברית או לבקש ממנו להשלים משפט, הוא לא יעשה עם זה כלום. מעבר לזה, בגלל היעדר כיול באמצעות imatrix, כל קובץ מתחת לרמת Q5 עלול לאבד פרטים קריטיים בהבנת הנחיות מורכבות, מה שיפגע ישירות באיכות התמונות שתקבלו בסוף התהליך.

שאלות
נפוצות

אפשר להשתמש במודל הזה בשביל צ'אטבוט?

לא. הקובץ מכיל אך ורק את המקודד של T5 ולכן הוא יודע רק לקרוא טקסט ולתרגם אותו למספרים, בלי יכולת לפלוט מילים בחזרה.

איזו גרסה כדאי להוריד מתוך ה־13?

היוצר ממליץ על Q5_K_M ומעלה. גרסאות קטנות יותר יעבדו על זיכרון נמוך אבל יפגעו בדיוק בגלל חוסר בכיול imatrix.

איך מריצים

את המשקלים מריצים ישירות דרך כלי ההטמעה של llama.cpp או באמצעות הרחבת ComfyUI-GGUF שמחברת אותו למודלים גרפיים. הקבצים הגדולים יותר דורשים כרטיס מסך עם זיכרון וידאו מכובד, אבל אפשר לרדת ברמת הקוונטיזציה כדי לדחוף אותו לכרטיסים צנועים יותר.

היוצר מציין במפורש שהכיבוס נעשה בלי imatrix כי התשתית לא תמכה בזה בזמן הבנייה, ולכן מומלץ לקחת לפחות את גרסת Q5_K_M. אם אתם יורדים מתחת לזה כדי לחסוך מקום, קחו בחשבון ירידה מורגשת בדיוק ההבנה של הטקסט.

ollama run hf.co/city96/t5-v1_1-xxl-encoder-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

רישיון Apache 2.0 פתוח לגמרי ומתיר שימוש מסחרי, שינוי קוד והפצה. אתם יכולים לשלב אותו במוצרים פרטיים או מסחריים בלי לשלם תמלוגים, כל עוד אתם שומרים על תנאי הקרדיט והודעת הרישיון המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗