GPT
A

Anima-INT8

קוד פתוח

Bedovyyother2026-02-12

  • diffusion-single-file
  • comfyui
  • text-to-image

גרסת כימות של מודל התמונה ANIMA שמכוונת לקצץ בזמני הריצה. אם אתם עובדים בתוך ComfyUI ומחפשים להאיץ יצירת תמונות בחומרה מקומית, זו הסיבה לבדוק אותה.

  • 27.2 GBמשקל הקבצים
  • 6,759הורדות בחודש
  • 47לייקים

מה זה

מדובר בגרסת INT8 של מודל יצירת התמונות ANIMA, שנועדה לאפשר ריצה מהירה יותר בהשוואה לגרסת הדיוק המקורית BF16. היוצר פרסם כאן קבצים בשני פורמטים עיקריים, int8rowwise שמותאם לעבודה ישירה מול ComfyUI, וגרסת int8convrot שמכוונת לאיכות תמונה גבוהה יותר במחיר של מהירות איטית יותר.

המספרים בבדיקות מראים שהתועלת של הכימות תלויה מאוד בסוג העבודה ובכרטיס המסך שלכם. בריצה רגילה ללא תוספות עם הידור מופעל, הכימות מספק שיפור של כ־13% בזמן היצירה ב־RTX 3060 ויורד מ־32.22 שניות ל־28.09 שניות, כשבכרטיס חזק כמו RTX 5090 הזמן נחתך מ־5.37 שניות ל־4.26 שניות. עם זאת, בשימוש בתוספי האצה כמו Turbo LoRA המצב מתהפך לפעמים, ולמרות קצב צעדים גבוה יותר לשנייה, זמני הריצה הכוללים בפועל יצאו לעיתים איטיים יותר מאשר ב־BF16 המקורי.

מתאים ל

  • עבודה מהירה ב־ComfyUI

    מתאים למי שמחזיק תחנת עבודה עם כרטיס Nvidia ומחפש לחסוך שניות בכל יצירה בעזרת התוסף הייעודי.

  • יצירה מבוססת Stochastic LoRA

    שימושי אם אתם משלבים LoRA מותאם, שכן במדידות מצב זה שמר על יתרון מהירות עקבי על פני BF16.

  • ייצור תמונות באיכות מוקפדת

    קובץ ה־int8convrot מאפשר יצירה עם דגש על איכות פלט טובה יותר על חשבון קצב העבודה.

איפה זה נופל

הבעיה המרכזית היא חוסר יציבות בביצועים ובאינטגרציה. התמיכה המובנית של ComfyUI בפורמט שורה של INT8 אינה מייצרת שיפור מהירות אמיתי מול BF16 ואף דחתה פורמטים מסוימים, מה שאילץ עדכונים ידניים והסתמכות על תוספים חיצוניים. בנוסף, שימוש ב־Dynamic LoRA עם הכימות הזה פשוט פוגע בביצועים ומציג זמני ריצה ארוכים יותר מאשר המודל הלא מכומת בכל כרטיסי המסך שנבדקו.

שאלות
נפוצות

האם המודל יעבוד ישירות ב־ComfyUI בלי תוספות?

הוא ייטען, אבל ComfyUI הבסיסי לא מציג שיפור מהירות מול BF16 בפורמט הזה. כדי לראות שיפור בפועל בזמני הריצה צריך להתקין את ComfyUI-INT8-Fast ולהגדיר את דגלי ההרצה המומלצים.

האם כדאי להשתמש בכימות הזה עם מודלי Turbo LoRA?

לא בטוח בכלל. הבדיקות בכרטיסים שונים הראו שלמרות שקצב הצעדים לשנייה עולה, זמן הריצה הכולל ב־INT8 עם טורבו היה לעיתים ארוך יותר מאשר בהרצת BF16 רגילה.

איך מריצים

ההרצה המקומית דורשת התקנה של התוסף ComfyUI-INT8-Fast בתוך תיקיית custom_nodes, ושימוש ברכיב טעינה ייעודי של W8A8. כדי לסחוט את הביצועים שהוצגו במבחנים, צריך להפעיל את ComfyUI עם דגלי ריצה ספציפיים שכוללים ביטול VRAM דינמי, האצת SageAttention, כפל מטריצות ב־FP8 ודחיפת פקודות הידור של PyTorch ו־Triton.

מבחינת חומרה, הבדיקות נערכו על כרטיסים החל מ־RTX 3060 ועד RTX 5090, כך שכרטיס של 12GB זיכרון ומעלה מסוגל להתמודד עם המשימה. אם אין לכם כרטיס Nvidia מודרני, או שאין לכם עניין להסתבך עם קונפיגורציות ידניות של תלויות CUDA ותוספי צד שלישי שנוטים להישבר בעדכונים, עדיף לייצר תמונות דרך שירות ענן חיצוני.

pip install -U huggingface_hub
hf download Bedovyy/Anima-INT8

הרישיון

הרישיון מוגדר כ־other ללא פירוט של תנאי שימוש ברורים, היתר מסחרי או הגבלות הפצה. כל עוד יוצר המודל או הפרויקט המקורי לא צירפו קובץ תנאים מסודר, אין לדעת אם מותר להשתמש בו במוצר מסחרי ואי אפשר להסתמך עליו בסביבה עסקית.

הרישיון המלא בעמוד המודל ↗