GPT
Z

Z-Anime

קוד פתוח

SeeSee21apache-2.02026-04-25

  • diffusers
  • safetensors
  • gguf
  • z-anime
  • text-to-image

מודל תמונות אנימה שמבוסס על Z-Image של עליבאבא עם אימון מלא ולא מיזוג LoRA. מתאים למי שרוצה שליטה מדויקת בסגנון בשפה טבעית ובלי צורך בשרת מפלצתי.

  • 189 GBמשקל הקבצים
  • 2,777הורדות בחודש
  • 485לייקים

מה זה

המודל הזה הוא אימון מלא של ארכיטקטורת S3-DiT בגודל 6 מיליארד פרמטרים מבית עליבאבא, שעבר התאמה מקיפה לסגנון אנימה. בניגוד לרוב הפרויקטים ברשת שמחברים כמה קובצי LoRA ומקווים לטוב, כאן שינו את משקלי הבסיס. זה נותן לו גמישות גבוהה בקומפוזיציות, זוויות צילום, והבעות פנים מורכבות בלי להישבר לדפוסים קבועים.

ההבדל המרכזי בעבודה היומיומית הוא פיענוח הפרומפט. הוא מתעלם כמעט לגמרי מרשימות תגיות נוסח Danbooru שמשתמשי סטייבל דיפיוז'ן רגילים להדביק, ודורש תיאור מלא באנגלית שוטפת דרך אנקודר הטקסט של Qwen. המאגר כולל חלוקה ברורה לצרכים שונים: גרסת בסיס שדורשת 28 עד 50 צעדים לקבלת איכות מקסימלית, ושתי גרסאות מזוקקות של 8 ו־4 צעדים לעבודה מהירה במיוחד. הגרסאות המזוקקות עובדות בערך CFG של 1.0 בלבד ומיועדות לריצות אצווה מהירות, בעוד גרסת הבסיס מאפשרת משחק מלא עם הנחיות שליליות וערכי הכוונה גבוהים יותר.

מתאים ל

  • איור דמויות אנימה מפורט

    גרסת הבסיס מספקת תאורה עדינה, קווים נקיים ושליטה מלאה בקומפוזיציה באמצעות פרומפטים מילוליים עשירים.

  • בדיקת רעיונות מהירה בסטודיו

    גרסת 4 צעדים בערך CFG 1.0 מייצרת סקיצות וקונספטים בקצב מהיר במיוחד על גבי חומרת קצה רגילה.

  • בסיס לאימון מודלי LoRA

    אימון הבסיס הרחב על ארכיטקטורת S3-DiT ותיקיית ה־diffusers המוכנה מהווים קרקע יציבה לכוונון נוסף.

איפה זה נופל

הוא מוגבל לאנגלית בלבד, ופרומפטים של מילות מפתח מופרדות בפסיקים ייצרו תוצאות ירודות ומבולבלות. בגרסאות המזוקקות של 4 ו־8 צעדים אין כמעט שום השפעה לפרומפט שלילי, וערכי CFG מעל 1.5 יגרמו לעיוותים חמורים בתמונה. גרסת 4 הצעדים מאבדת פרטים עדינים ומחייבת שימוש במודל השבחה חיצוני כמו SeedVR2, ויכולות ה־NSFW מוגדרות כחלקיות בלבד ולא עקביות.

שאלות
נפוצות

האם צריך להוריד את כל 189 הגיגה כדי להשתמש בו?

ממש לא. המשקל הכולל נובע מכך שהמאגר מכיל את כל הווריאציות יחד, מ־BF16 ועד GGUF וקבצי All-in-One. בפועל אתם בוחרים קובץ AIO יחיד ב־FP8 ששוקל סביב 6 גיגה, או מודל GGUF מכווץ של 4.2 גיגה.

למה התמונות יוצאות מקולקלות עם תגיות רגילות?

המודל מאומן מול אנקודר טקסט של Qwen ומכוון לשפה טבעית מלאה. במקום לכתוב רשימת מילים מופרדת בפסיקים כמו בסטייבל דיפיוז'ן הישן, יש לכתוב תיאור עלילתי של הדמות, הרקע, הצבעים והתאורה.

איך מריצים

כל המאגר שוקל 189 גיגה בגלל כפילויות של גרסאות, אבל אתם מורידים רק קובץ אחד או שניים. המודלים תוכננו לרוץ על כרטיס עם 8GB זיכרון וידאו. גרסאות AIO מאחדות את המודל, ה־VAE ומפענח הטקסט לקובץ בודד לטעינה פשוטה ב־ComfyUI. אם הזיכרון חנוק, קבצי GGUF כמו Q4_K_S יורדים ל־4.2 גיגה ורצים גם על מעבד או כרטיסי AMD, בעוד גרסאות FP8 סביב 6 גיגה נותנות את היחס הכי נכון בין מהירות לאיכות. מי שמפתח בקרביים יכול לטעון את תיקיית diffusers ישירות בפייתון לקוד עצמאי או אימוני המשך.

ollama run hf.co/SeeSee21/Z-Anime:Q4_K_S

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

52 קבצים במאגר, 189 GB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

רישיון Apache 2.0 מאפשר שימוש מסחרי מלא, הפצה, שינוי ושילוב במוצרים סגורים בלי תמלוגים. התנאי היחיד הוא שמירה על הודעות זכויות היוצרים והרישיון המקורי, והצהרה על שינויים שנעשו בקוד או במשקלים.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗