GPT
T

Tifa-Deepsex-14b-CoT

קוד פתוח

ValueFX9507apache-2.02025-02-04

  • transformers
  • gguf
  • incremental-pretraining
  • sft
  • reinforcement-learning

התאמה ייעודית של מודל החשיבה DeepSeek-R1-14B למשחקי תפקידים וכתיבת פרוזה. היוצרים הוסיפו לו מאות מיליארדי טוקנים של סיפורת כדי לפתור את היובש של מודל המקור.

  • 82.6 GBמשקל הקבצים
  • 322הורדות בחודש
  • 229לייקים

מה זה

המודל הזה לוקח את הבסיס של DeepSeek-R1-14B ומנסה לתקן את מה שחסר בו כשכותבים עלילה. במקור, מודלים מסוג R1 מצטיינים במתמטיקה ולוגיקה, אבל קורסים בטקסט סיפורי מתמשך או נשמעים נוקשים ומלאי אנגלית. המפתחים אימנו אותו על 0.4 טריליון טוקנים של רומנים וסיפורת, שילבו נתוני שיחה ממודל Tifa-220B, וביצעו כוונון עדין על אשכול של שמונה מאיצי H20 כדי לשמר את שרשרת החשיבה בלי לאבד את הזרימה הטבעית.

בפועל, הגרסה הזו מוגדרת על ידי המפתח כגרסת בדיקה ראשונית. היא נותנת חופש יצירתי גדול ופחות נוטה לסירובים, אבל מתקשה לשמור על ריסון. מי שמחפש עברית יגלה מהר מאוד שהאימון התמקד כולו בסינית ובאנגלית, כך שהמודל מגיב בשפות האלו בלבד ולא בנוי לעבודה מקומית בעברית.

מתאים ל

  • משחקי תפקידים בסיפורת

    הוא אומן על נתוני דמויות כדי לנהל אינטראקציות עלילתיות ארוכות בלי להיתקע בתשובות יבשות.

  • כתיבה יוצרת עם חשיבה

    מנגנון החשיבה מאפשר לו לתכנן מראש את מהלכי העלילה והאווירה לפני שהוא פולט את הסיפור עצמו.

  • מחקר על אלגוריתמי חיזוק

    המשקל מיועד לבדיקת השפעת תגמולי למידת חיזוק על יצירתיות וחופש טקסטואלי במודלים בינוניים.

איפה זה נופל

המפתח מודה במפורש שזו גרסת ניסוי ראשונית שסובלת מבעיות שליטה. תהליך החשיבה נוטה להתפזר ולהתנתק מהטקסט שהוא פולט, וקלט קצר מדי או עמום כמו 'תמשיך' גורם לו לחזור על אותם משפטים שוב ושוב בגלל חפיפת וקטורים. הוא לא מתאים בשום אופן לקוד, לפתרון בעיות מתמטיות או למתן תשובות עובדתיות קצרות, כי כל האימון שלו הסיט אותו לכיוון בדיוני וחופשי מדי.

שאלות
נפוצות

האם המודל תומך בעברית לשיחה שוטפת?

לא. נתוני האימון כללו סיפורת בסינית ובאנגלית בלבד, ואין לו יכולת מובנית לנהל דיאלוגים או כתיבה יוצרת בעברית.

למה המודל מפסיק לתפקד אחרי כמה הודעות בצ'אט?

הארכיטקטורה מחייבת לחתוך את בלוק החשיבה מהתשובה לפני שמצרפים אותה להיסטוריה. אם ממשק השיחה שלכם לא מנקה את תגיות המחשבה, המודל מאבד הקשר ומתחיל להזות.

איך מריצים

המשקל המלא של הקבצים מגיע ל־82.6 ג'יגה בייט בפורמט transformers, מה שדורש לפחות שני כרטיסי RTX 3090 או A100 בודד כדי לטעון אותם בזיכרון המלא. אם אין לכם שרת ייעודי כזה בבית או בענן, עדיף להוריד את גרסאות ה־GGUF המכווצות כמו Q4 או Q8 ולהריץ דרך Ollama על חומרה צנועה בהרבה.

נקודה קריטית בהרצה היא ניהול הזיכרון של השיחה. חובה להסיר את תגיות החשיבה והתוכן שבתוכן מההודעות הקודמות של המודל לפני ששולחים את ההיסטוריה בחזרה לפרומפט הבא. אם לא מנקים את החשיבה מההיסטוריה בקוד, המודל משתבש לחלוטין ומפסיק לענות בצורה הגיונית.

ollama run hf.co/ValueFX9507/Tifa-Deepsex-14b-CoT:F16

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מפורסם תחת רישיון apache-2.0, שמתיר שימוש מסחרי, שינוי קוד והפצה חופשית ללא תמלוגים. עם זאת, בעמוד המודל מצוין תנאי נוסף שמחייב ציות להסכם השימוש של Tifa וזכויות יוצרים על ספרי המקור, כך ששילוב שלו במוצר מסחרי עלול להיתקל במגבלות משפטיות מעבר להיתר של אפאצ'י.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗