GPT
T

Tifa-Deepsex-14b-CoT-GGUF-Q4

קוד פתוח

ValueFX9507apache-2.02025-02-04

  • transformers
  • gguf
  • incremental-pretraining
  • sft
  • reinforcement-learning

התאמה של DeepSeek-R1 בגודל 14B שנבנתה מחדש עבור משחקי תפקידים וכתיבת פרוזה. הוא משלב שרשרת חשיבה עם אימון על ספרי קריאה כדי לשמור על עלילה רציפה.

  • 24.4 GBמשקל הקבצים
  • 4,539הורדות בחודש
  • 847לייקים

מה זה

הבסיס הוא DeepSeek-R1-14B, שעבר אימון המשך על 0.4 טריליון טוקנים של ספרות, לצד מאה אלף דוגמאות אימון ממודל Tifa וחיזוקים בלמידת חיזוק. המטרה כאן הייתה לפתור את היובש והניתוק העלילתי של מודל המקור, ולהכניס עומק לכתיבה יוצרת.

התוצאה מתמקדת בשמירה על עקביות בשיחות ארוכות, הרחבת אוצר המילים לדיאלוגים מורכבים והפחתת סירובים. המודל שומר על שלב החשיבה המובנה של R1 לפני שהוא פולט את הטקסט, ומיועד לסינית ולאנגלית. אין כאן שיפור למשימות קוד או עובדות, והיכולות נותבו לחלוטין לטובת סיפור ודמויות.

מתאים ל

  • משחקי תפקידים מבוססי טקסט

    הוא אומן להחזיק דמויות מורכבות ודיאלוגים ממושכים בלי לשבור את המוסכמות של העלילה.

  • כתיבת ספרות ופרוזה

    אימון ההמשך על טקסטים ספרותיים מספק לו סגנון עשיר יותר ממודלי שיחה רגילים.

  • הסקה עם תהליך מחשבה מקדים

    הוא מנתח את התנהגות הדמות ומניעיה בתוך תגיות החשיבה לפני הפקת התגובה הגלויה.

איפה זה נופל

המודל סובל מבעיות התנהגות מובנות שהמפתחים מציינים בגלוי. קלטים קצרים וסתמיים, כמו בקשה להמשיך, גורמים לו להיתקע בלולאות חזרתיות. בנוסף, שלב החשיבה נוטה להתפזר ולהתרחק מהטקסט שהוא פולט בפועל, מה שיוצר לעיתים חוסר קשר בין המחשבה לתוצאה.

חובה לתקן את ממשק המשתמש שלכם כדי שיסיר את תגיות החשיבה מההיסטוריה שנשלחת חזרה למודל, אחרת התשובות הבאות נשברות לחלוטין. הוא אינו מיועד למתמטיקה, לתכנות או לשליפת מידע עובדתי.

שאלות
נפוצות

האם המודל מתאים לשימוש בעברית?

הנתונים הרשמיים מגדירים תמיכה בסינית ובאנגלית בלבד. אימון ההמשך הספרותי התמקד בשפות אלו, ולכן פנייה בעברית צפויה להניב תוצאות שבורות או איכות ניסוח נמוכה.

למה המודל מפסיק לענות בהיגיון אחרי כמה הודעות?

הוא מחייב ניקוי של תגיות החשיבה מתוכן התשובות הקודמות לפני שליחתן שוב לבקשה הבאה. אם הממשק שלכם שומר את תגיות ה־think בהיסטוריה, המודל מתבלבל ומייצר פלט לא תקין.

איך מריצים

הקבצים בפורמט GGUF מחולקים לשבעה חלקים בנפח כולל של 24.4 גיגה בייט. למרות שמדובר בכינוי Q4 בשם המאגר, המפתחים עצמם מזהירים שרמת דיוק זו סובלת מאובדן איכות מורגש וממליצים לעלות לגרסת Q8 אם החומרה מאפשרת.

להרצה מקומית תצטרכו מעבד גרפי עם מספיק זיכרון וידאו, לפחות 16 עד 24 גיגה בייט בהתאם לקוונטיזציה ולהקשר שתרצו לפתוח. אם המטרה היא בדיקה חד פעמית או שאין ברשותכם כרטיס מתאים, סביר יותר לשכור מכונה לפי שעה בענן או להישען על שרתי הסקה ייעודיים.

ollama run hf.co/ValueFX9507/Tifa-Deepsex-14b-CoT-GGUF-Q4:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המאגר מוגדר תחת רישיון Apache 2.0, שמאפשר שימוש מסחרי, שינוי והפצה של הקוד והמשקלים ללא תמלוגים, בכפוף למתן קרדיט. עם זאת, היוצרים מציינים תנאי שימוש ייעודיים של Tifa עבור נתוני התפקידים, ומחייבים עמידה בחוק המקומי בנוגע לתכנים שנוצרים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗