GPT
S

Sakura-GalTransl-14B-v3.8

קוד פתוח

SakuraLLMcc-by-nc-sa-4.02025-04-29

  • gguf
  • endpoints_compatible
  • imatrix
  • conversational

מודל תרגום ממוקד לרומנים חזותיים ולייט נובלס, שנבנה על בסיס מודל 14B של Qwen2.5. מי שמוריד אותו מחפש ספציפית איכות טקסט סיפורית ולא תרגום מכונה כללי ויבש.

  • 71.2 GBמשקל הקבצים
  • 8,604הורדות בחודש
  • 39לייקים

מה זה

הבסיס כאן הוא Sakura-14B-Qwen2.5-v1.0, והוא מהווה את גרסת 14B של פרויקט GalTransl-v3. המפתחים מציינים שהמעבר לנפח של 14 מיליארד פרמטרים מציג איכות כוללת עדיפה בבירור על פני גרסת ה־7B שלהם, במיוחד בכל הקשור לשפה ספרותית ולדיאלוגים מורכבים.

גרסה 3.8 מביאה שיפור בסגנון הכתיבה ומתקנת בעיות קודמות שבהן תווי בקרה נשארו בטקסט המתורגם. זה מצטרף לשיפורי למידת חיזוק מגרסה 3.7 שהפחיתו שגיאות בכינויי גוף. המפתחים ממליצים להריץ אותו עם טמפרטורה של 0.3 ו־top_p של 0.8 כדי לשמור על תרגום מדויק ועקבי.

מתאים ל

  • תרגום רומנים חזותיים

    נבנה ואומן במיוחד לשפה ספרותית, דיאלוגים מורכבים ושמירה על סגנון עלילתי.

  • עיבוד טקסטים באצווה גדולה

    תומך בהרצה של 16 תהליכונים ומגיע לקצב מוצהר של 30 אלף משפטים בשעה ב־GGUF.

  • קריאת לייט נובלס מקומית

    מאפשר הרצה מקומית מלאה ללא תלות ברשת למשתמשים עם חומרת קצה מתאימה.

איפה זה נופל

זה לא מודל שיחה כללי ולא מתאים למשימות קוד או ניתוח נתונים, אלא מנוע תרגום ייעודי. הגרסאות הקודמות סבלו מתווי בקרה שזלגו לפלט ומטעויות בזיהוי גוף יחיד ורבים, ואף שהגרסה הנוכחית מתקנת זאת, תרגום יצירתי תמיד דורש בדיקה אנושית. אם המטרה שלכם היא עברית, אין בכרטיס המודל שום אינדיקציה שהוא אומן עליה או תומך בה.

אותה משפחה

Sakura-GalTransl יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

האם אפשר להשתמש בו במוצר מסחרי?

לא. הרישיון הוא מסוג NC, כלומר שימוש לא מסחרי בלבד. כל הטמעה באפליקציה בתשלום או במערכת עסקית מפרה את תנאי המפיצים.

איזו חומרה צריך כדי לקבל ביצועים סבירים?

היוצרים ממליצים על כרטיס Nvidia RTX 4090 עם שרת llama.cpp כדי להוריד את כל השכבות לכרטיס. על חומרה חלשה יותר או עם פחות זיכרון גרפי, המודל פשוט יזחל.

איך מריצים

הגרסה שמגיעה ללא סיומת היא בכימות Q6_K, ויש קובץ GGUF ישיר להורדה. המפתחים מכוונים לפריסה דרך llama-server עם llama.cpp, ומציעים להריץ אותו על כרטיס RTX 4090 עם חלון הקשר של 32,768 טוקנים ודחיפת כל השכבות ל־GPU.

מי שאין לו כרטיס מקומי חזק של 24GB VRAM יתקשה מאוד ליהנות ממנו, שכן המשקל הכולל של הקבצים מגיע ל־71.2 גיגה־בייט. בריצה עם 16 תהליכונים מקבילים, המפתחים מדווחים על קצב של כ־30,000 משפטים בשעה.

ollama run hf.co/SakuraLLM/Sakura-GalTransl-14B-v3.8:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא cc-by-nc-sa-4.0. המשמעות ברורה, אסור להשתמש במודל הזה לשום מטרה מסחרית או להטמיע אותו במוצר שמייצר הכנסות. בנוסף, כל שיתוף של יצירה נגזרת מחייב מתן קרדיט והפצה תחת אותו רישיון בדיוק.

  • שינוי הקוד
  • חובת ייחוס
  • שימוש מסחרי: לא

הרישיון המלא בעמוד המודל ↗