GPT
P

pony-v7-base

קוד פתוח

purplesmartaiother2025-10-22

  • diffusers
  • safetensors
  • gguf

המודל מייצר תמונות של דמויות במגוון סגנונות, מאנימה ועד ריאליזם, עם דגש על אינטראקציות מורכבות. הוא נשען על ארכיטקטורת AuraFlow ומבין שפה טבעית לצד תגיות.

  • 6.9Bפרמטרים
  • 56.6 GBמשקל הקבצים
  • 43,764הורדות בחודש
  • 102לייקים

מה זה

הגרסה הזו מתבססת על ארכיטקטורת AuraFlow ומיועדת ליצירת תווים, דמויות אנתרופומורפיות וסגנונות מאוירים שונים. האימון נעשה על כעשרה מיליון תמונות שעברו סינון קפדני, עם חלוקה שווה בין אנימה, תוכן מצויר ותכנים אחרים, וכן איזון בין רמות חשיפה שונות. ביחס לגרסה שקדמה לו, הוא מבין טוב יותר יחסים מרחביים בין מספר ישויות ומייצר רקעים מפורטים, לצד תמיכה בתאורות קיצוניות וברזולוציות שמגיעות עד 1536 על 1536 פיקסלים.

מבנה הפרומפט המומלץ משלב תיאור עובדתי של הדמות עם הגדרות סגנון ותגיות. המודל מסוגל לזהות שמות של דמויות ספציפיות ממקורות שונים, ומגיב היטב לטקסט חופשי רגיל. עם זאת, היוצרים בחרו להסיר שמות של אמנים ממאגר האימון, כך שלא ניתן לחקות סגנון ישיר של מאייר מסוים בעזרת שמו בלבד.

מתאים ל

  • איור דמויות מורכבות

    יצירת סצנות שמכילות אינטראקציה בין כמה דמויות שונות עם שליטה ברקע ובמיקום.

  • הפקת קונספט ארט

    בניית סקיצות לאנימציה ומשחקים ברזולוציה גבוהה של עד 1536 פיקסלים ללא צורך בהגדלה.

  • אימון LoRA ייעודי

    התאמת המודל לדמויות חדשות באמצעות SimpleTuner והמרת המשקולות לשימוש נוח.

איפה זה נופל

היוצרים מציינים במפורש שהמודל גרוע מאוד בייצור טקסט בתוך תמונות, תחום שבו הוא נופל אפילו מ־AuraFlow המקורי. פרטים קטנים ובמיוחד פנים סובלים לעיתים מעיוותים וירידה באיכות בגלל רכיב VAE מיושן ואימון שטרם הושלם במלואו. בנוסף, תגיות הדירוג והאיכות המוכרות מהגרסאות הקודמות עובדות כאן באופן לא עקבי ולא מבטיחות שיפור בתוצאה, כך שתצטרכו להסתמך בעיקר על ניסוח ידני מפורט.

שאלות
נפוצות

האם המודל הזה מתאים להטמעה במוצר מסחרי?

רק תחת תנאים מגבילים מאוד. אם ההכנסות שלכם עוברות מיליון דולר או שאתם מציעים אפליקציית מחולל תמונות ללקוחות, הרישיון אוסר זאת ותצטרכו לקבל אישור ישיר או לעבוד מול ה־API הרשמי.

איך כדאי לכתוב לו פרומפטים כדי לקבל תוצאות טובות?

מומלץ לתאר קודם כל את הדמות בצורה עובדתית עם מין, זן ושם המקור, לאחר מכן להוסיף את תיאור הסגנון והתאורה, ובסוף לחזק בעזרת תגיות כלליות. תגיות איכות קלאסיות לא בהכרח יעזרו כאן.

האם יש תמיכה ברינדור אותיות ומילים בתוך התמונה?

לא. היוצרים מצהירים בגלוי שהיכולת לייצר טקסט נפגעה משמעותית באימון הזה, ולכן לא כדאי לבנות עליו לעיצוב שלטים, לוגואים או כרזות שמכילות מילים.

איך מריצים

בגלל משקל קבצים של 56.6 גיגה בייט וכמעט שבעה מיליארד פרמטרים, הרצה מקומית מלאה דורשת כרטיס מסך כבד עם נפח זיכרון משמעותי. כדי להקל על העומס, זמינות גרסאות GGUF מכווצות שמתאימות לזיכרון נמוך יותר, כשהמלצת היוצרים היא גרסת Q8_0, או קובצי safetensors בודדים לטעינה פשוטה יותר. המודל פועל ישירות דרך ספריית diffusers או ComfyUI באמצעות תהליכי עבודה ייעודיים, ודורש לפחות 30 צעדים כדי לקבל תמונה תקינה.

אם אין לכם חומרה ייעודית לתמונות ברזולוציה גבוהה, הרצה עצמאית תהיה איטית ומסורבלת. במקרים כאלה עדיף לפנות ל־API המסחרי הרשמי שהיוצרים מספקים דרך פלטפורמת FAL.ai, במקום להחזיק שרתים מקומיים יקרים.

ollama run hf.co/purplesmartai/pony-v7-base:Q4_0

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר תחת תנאי pony license ומגביל מאוד שימוש מסחרי ישיר. מותר להשתמש בפלטים באופן מסחרי רק אם אינכם מפעילים שירות הסקת מסקנות, החברה שלכם מגלגלת פחות ממיליון דולר הכנסות, ואינכם משלבים את התמונות בהפקות וידאו מקצועיות. שירותי צד שלישי שרוצים לספק גישה למודל חייבים אישור מפורש מהיוצרים או שימוש ב־API הרשמי.

הרישיון המלא בעמוד המודל ↗