GPT
S

Sakura-13B-Galgame

קוד פתוח

sakuraumiapache-2.02023-08-26

  • transformers
  • pytorch
  • baichuan
  • text-generation
  • custom_code

תרגום ייעודי של משחקי visual novel ורומנים קלים מיפנית לסינית. המודל עבר אימון ספציפי על שפה וסגנון של עולמות התוכן האלה.

  • 124 GBמשקל הקבצים
  • 122הורדות בחודש
  • 129לייקים
  • 40שכבות

מה זה

הפרויקט מתמקד במשימה מוגדרת אחת, תרגום טקסטים מיפנית לסינית פשוטה בסגנון אנימה, מנגה ורומנים קלים. המאגר כולל היסטוריה של גרסאות, החל מאימון על בסיס Baichuan2-13B-Chat בארכיטקטורת 40 שכבות ובהמשך מעבר לסדרות Qwen, כולל שחרורים מאוחרים יותר בגדלים של 14B, 7B וגרסאות מוקטנות. הוא מיועד לעבוד מקומית או בשרת פרטי ומספק ממשק תואם OpenAI.

בניגוד למודלי שפה כלליים בגודל 13B או 14B שנוטים לאבד הקשרים סגנוניים של דיאלוגים יפניים, ההתאמה כאן נעשתה ישירות על תרגומים קיימים מהתחום. המודל מתמקד בשמירה על כינויי גוף נכונים ומשתלב ישירות בתוכנות תרגום קיימות כמו LunaTranslator ו־GalTransl. נתוני הערכה רשמיים כמו BLEU או PPL טרם פורסמו בכרטיס, אך יש דוגמאות תרגום בפועל ומערכות חיצוניות שמריצות אותו באופן שוטף.

מתאים ל

  • תרגום רומנים קלים

    קריאת ספרי רשת וקבצי טקסט מיפנית לסינית, תוך שמירה על משלב דיבור שמתאים לספרות פופולרית.

  • תרגום חי במשחקי מחשב

    חיבור לתוכנות כמו LunaTranslator להצגת כתוביות ותרגום בזמן אמת של משחקי visual novel.

  • בניית טלאי תרגום למשחקים

    הפקת תרגום מקומי לקבצי תסריט של מנועי Unity ו־RPGMaker באמצעות כלי אוטומציה תואמים.

איפה זה נופל

היוצרים מודים בבעיות עקביות בכינויי גוף, בלבול בין זכר לנקבה, הוספת כינויים שלא קיימים במקור וקשיים בהבנת הקשר רחב. המודל רגיש מאוד לתבנית הבקשה, ואם תשתמשו בפרומפט שונה מהמבנה שהוגדר, איכות התרגום תיפגע באופן משמעותי. יש גם תופעות של התנוונות פלט בלולאות, שמחייבות כוונון של פרמטר frequency_penalty לערכים סביב 0.1 או 0.2. הוא מתרגם רק מיפנית לסינית, ואינו תומך בעברית או בשפות אחרות.

שאלות
נפוצות

האם המודל יודע לתרגם ליפנית, לאנגלית או לעברית?

לא. הוא אומן באופן בלעדי על כיוון תרגום אחד, מיפנית לסינית פשוטה. הוא לא מיועד לשפות אחרות ולא יפיק תוצאות שמישות בעברית.

האם אפשר להשתמש במודל במוצר מסחרי?

לא. למרות שרשום apache-2.0 בהגדרות המאגר, יוצרי המודל החילו עליו רישיון CC BY-NC-SA 4.0 שאוסר כל שימוש מסחרי במודל או בנגזרותיו.

התרגום חוזר על עצמו או משבש כינויי גוף, איך מתקנים?

חובה להשתמש בתבנית המדויקת שהוגדרה בתיעוד לגרסה שברשותכם. אם הטקסט מתנוון או נתקע בלולאות, הגדירו את פרמטר frequency_penalty לטווח של 0.1 עד 0.2.

איך מריצים

משקל הקבצים במאגר המקורי עומד על 124 גיגה בייט בפורמט bfloat16, אך בפועל גרסאות ה־GGUF הן אלו שמשמשות להרצה. עבור מודל 14B בגרסת Q4_K_M דרוש כרטיס מסך עם לפחות 16 גיגה זיכרון, ובגרסת Q8_0 תצטרכו 24 גיגה. הרצה מלאה ב־fp16 דורשת 26.3 גיגה זיכרון וידאו ומעבר ליכולת של כרטיסים ביתיים סטנדרטיים.

אפשר להריץ אותו דרך ספריית transformers, מנוע vllm או בעזרת llama.cpp, ויש גם תמיכה בחיבור תואם OpenAI API מול שרת מקומי. אם אין לכם חומרה ייעודית, Kaggle חוסם את השימוש במאגר הזה, כך שפתרון ריצה עצמי מחייב שרת שכור עם מעבד גרפי מתאים.

from transformers import pipeline

pipe = pipeline("text-generation", model="sakuraumi/Sakura-13B-Galgame")
print(pipe("שלום"))

הקבצים

61 קבצים במאגר, 124 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

למרות שבמטא־דאטה מסומן רישיון apache-2.0, הטקסט מבהיר חד־משמעית שכל הגרסאות כפופות לרישיון CC BY-NC-SA 4.0 לצד תנאי השימוש של Baichuan2 ו־Qwen. המשמעות היא איסור מוחלט על שימוש מסחרי מכל סוג, חובת שיתוף תחת אותו רישיון, ודרישה לסמן בבירור כל תוצר כתרגום מכונה. המודל מיועד ללמידה ומחקר בלבד.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗