GPT
C

chatterbox-gguf

קוד פתוח

calcuismit2025-06-02

  • gguf
  • gguf-connector
  • text-to-speech
  • en

גרסת GGUF מכווצת למודל הדיבור של ResembleAI. הוא נועד למי שרוצה להפיק דיבור מקומי באנגלית בלי תלות ברשת ועם שליטה מלאה בקבצים.

  • 16.6 GBמשקל הקבצים
  • 2,570הורדות בחודש
  • 55לייקים

מה זה

מדובר בהמרה של Chatterbox לתבנית GGUF, המיועדת להרצה מקומית של סינתזת דיבור מטקסט. המבנה כאן מפוצל לכמה רכיבים נפרדים, ביניהם מקודד, מודל שפה ורכיב יצירת האודיו, שכל אחד מהם מגיע ברמות כימות שונות. החידוש המרכזי מול מודלים רגילים במשקל הזה הוא האפשרות לערבב בין קובצי המשקלים לפי משאבי המחשב, במקום להוריד מודל אחד כבד וקשיח.

הפרויקט נשען על הכלי gguf-connector ומציע גם ממשק ווב מקומי בסיסי שרץ על פורט 7860. הוא מתאים בעיקר למפתחים שרוצים שילוב ישיר בסקריפטים מקומיים או במערכות עצמאיות, בלי להתעסק עם שרתי ענן של צד שלישי.

מתאים ל

  • סינתזת דיבור מקומית

    מתאים למי שרוצה להפיק קריינות ישירות מהמחשב בלי לשלוח טקסט לשרתים חיצוניים ובלי עלויות לפי דקה.

  • בוטים קוליים באנגלית

    חיבור ישיר לממשק ווב מקומי בפורט 7860 עבור מענה קולי אוטומטי במערכות סגורות.

  • ניסויי כימות בחומרה מוגבלת

    שילוב גמיש בין גרסאות קלות כמו q4 לגרסאות כבדות יותר כדי למצוא איזון בין מהירות לאיכות.

איפה זה נופל

ההתקנה כאן מועדת לבעיות תאימות. בגרסת c3 למשל, הדף מציין שצריך לשנמך ידנית את ספריית transformers לגרסה 4.46.3, לעדכן את chichat לגרסה 0.0.4, ולהחליף את קובץ ה־clip בגרסה אחרת. בנוסף, המודל הראשי מכוון לאנגלית בלבד, כך שאין כאן תמיכה בעברית או בניקוד מקומי. הפיצול לשלושה קבצים נפרדים מחייב אתכם לדעת בדיוק מה בחרתם, ואם תטעו באחד מהם התהליך פשוט ייכשל.

שאלות
נפוצות

האם המודל תומך בעברית?

לא. המודל מוגדר עבור השפה האנגלית בלבד, ואין לו תמיכה בטקסט עברי או בהגייה מקומית.

צריך להוריד את כל 16.6 הגיגה־בייט?

ממש לא. המאגר כולל מגוון רחב של גרסאות וכימותים שונים. אתם צריכים להוריד רק שלושה קבצים תואמים לפי הבחירה שלכם.

איך מריצים

כדי להריץ אותו משתמשים בפקודה ggc c2 או c3 מתוך חבילת הפייתון gguf-connector. בהפעלה הראשונה התוכנה מושכת רק את הטוקנייזר, ואת שאר הקבצים צריך להוריד ולבחור ידנית מתוך התיקייה: קובץ ve, קובץ t3 וקובץ s3gen. המפתח ממליץ על ve_fp32-f16, על t3_cfg-q4_k_m, ועל s3gen-bf16 למי שמחזיק כרטיס של נווידיה, או f16 למי שעובד על מעבד רגיל.

סך כל הקבצים שפורסמו מגיע ל־16.6 גיגה־בייט ב־40 קבצים שונים, אבל בפועל מורידים רק את השילוב הנבחר. אם המחשב שלכם חלש מדי או שאין לכם כוח לנהל שלוש תלויות שונות של קבצים מכווצים, שירותי ענן עם API מוכן יחסכו את כל ההרכבה הזו.

ollama run hf.co/calcuis/chatterbox-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל מופץ תחת רישיון MIT. המשמעות פשוטה: מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו הלאה במוצרים שלכם, כל עוד שומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗