GPT
F

fable-traces

קוד פתוח

AliesTahaapache-2.02026-07-03

  • transformers
  • safetensors
  • qwen3
  • text-generation
  • instruct

גרסת כוונון עדין למודל קומפקטי שמיועדת לתשובות שיחה קצרות. מתאים למי שמחפש ריצה עצמית זולה בלי להסתבך עם שרתים כבדים.

  • 4Bפרמטרים
  • 262,144טוקנים בהקשר
  • 7.5 GBמשקל הקבצים
  • 374הורדות בחודש

מה זה

מדובר במודל שפה שנבנה על בסיס Qwen3 בגודל 4 מיליארד פרמטרים, עם ארכיטקטורה של 36 שכבות והתאמה להנחיות שיחה. הרעיון כאן הוא לייצר תשובות קצרות וממוקדות במקום פסקאות ארוכות ומייגעות, בדיוק מה שצריך כשבונים בוט שמגיב מהר ולא אמור לכתוב עבודות אקדמיות.

הוא מגיע עם תמיכה באנגלית בלבד ויושב על משקל של שבעה וחצי גיגה בייט. אין כאן טבלאות ביצועים מפורטות או מבחני השוואה רשמיים בכרטיס המודל, אלא התמקדות בהרצה פשוטה יחסית של מודל קטן שמסוגל לתת מענה מיידי לשיחות קצרות.

מתאים ל

  • ניסויים מקומיים

    משקל קל של שבעה וחצי גיגה שמאפשר לבדוק הרצה מקומית על מחשב פיתוח פשוט.

  • בוט שיחה באנגלית

    התאמה לתשובות קצרות שלא דורשות יצירת טקסטים מורכבים.

  • בדיקת שרתי vLLM

    מודל קטן ונוח כדי לבדוק שהקונפיגורציה של שרת ההסקה עובדת כמו שצריך.

איפה זה נופל

היוצר מציין במפורש בתחתית הדף שמדובר בבדיחה ולא במודל אמיתי. מעבר לזה, המודל מוגדר לאנגלית בלבד, כך שאין מה לבנות עליו לעברית. אין נתוני בנצ'מרק, אין שום פירוט על סט הנתונים ששימש לאימון, ואי אפשר לדעת איך הוא יתנהג בפועל. להכניס דבר כזה לסביבת ייצור זו טעות גדולה.

שאלות
נפוצות

האם כדאי להשתמש בו למוצר אמיתי?

ממש לא. כרטיס המודל מצהיר בפירוש שמדובר בבדיחה ושזה אינו מודל אמיתי. אין לו בדיקות איכות, אין תיעוד אימון, והרצה שלו במוצר מסחרי היא הימור מיותר.

איך הוא עובד בעברית?

הוא מוגדר רשמית לאנגלית בלבד. מודלים בגודל 4 מיליארד שלא אומנו על עברית בדרך כלל מייצרים שגיאות קשות או מסרבים לענות, כך שהוא לא מתאים למשימות בשפה המקומית.

איך מריצים

טוענים אותו ישירות דרך transformers בפייתון עם bfloat16 ומיפוי אוטומטי לכרטיס, או מרימים שרת מקומי עם vLLM בפקודה אחת פשוטה. שבעה וחצי גיגה בייט של קבצים אומרים שכרטיס מסך ממוצע עם 12 או 16 גיגה זיכרון יחזיק אותו בלי בעיה ובלי שתצטרכו שרת יקר.

אם אתם לא רוצים להחזיק שרת דלוק ולתחזק תשתית משלכם בשביל כמה שיחות ביום, עדיף להשתמש ב־API חיצוני של מודלים מוכנים. ריצה עצמית כאן משתלמת רק אם אתם חייבים פרטיות מלאה או שליטה מוחלטת בזמני התגובה.

from transformers import pipeline

pipe = pipeline("text-generation", model="AliesTaha/fable-traces")
print(pipe("שלום"))

הרישיון

הרישיון המדווח הוא Apache 2.0. הוא מתיר שימוש מסחרי, שינוי של הקוד והפצה חופשית, בתנאי ששומרים על הודעת זכויות היוצרים והרישיון המקורי בתוך המוצר שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗