GPT
H

hidream-gguf

קוד פתוח

calcuismit2025-04-14

  • gguf
  • gguf-node
  • text-to-image
  • en

גרסת GGUF מלאה של מודל יצירת התמונות HiDream שנועדה לעבודה מקומית בתוך ComfyUI. מקבלים כאן המרה מכווצת של המודל, המקדדים וה־VAE בחבילה אחת.

  • 1.1 TBמשקל הקבצים
  • 6,191הורדות בחודש
  • 70לייקים

מה זה

המאגר הזה מביא המרות GGUF של סדרת HiDream-i1-Full שיצרו ב־HiDream-ai, וכולל כמה וריאציות של המודל כמו גרסאות full, dev, fast, e1 ו־e1-1. המטרה של המרה כזו היא לאפשר הרצה מקומית בלי להחזיק משקלי FP16 או FP32 מלאים שתופסים נפח עצום בזיכרון, תוך שמירה על איכות יצירת התמונה מטקסט.

בניגוד לחבילות שמשאירות את המקודדים בפורמט המקורי ומכווצות רק את מנוע הדיפוזיה, calcuis ארז בפורמט הזה את כל החלקים הנדרשים. זה אומר שגם מודל הדיפוזיה, גם מקודדי הטקסט השונים וגם ה־VAE מגיעים כולם ב־GGUF, מה שמקל על שילוב חלק בצנרת העבודה בלי להיתקע עם צווארי בקבוק לא צפויים בטעינת משקלים שונים.

מתאים ל

  • עבודה מקומית ב־ComfyUI

    חיבור ישיר לתהליכי עבודה קיימים בבלוקים בלי להתעסק בהמרות פורמטים ידניות.

  • יצירת תמונות בחומרה מוגבלת

    משקלי ה־GGUF מאפשרים להריץ את המודל על כרטיסי מסך שלא היו מחזיקים את הגרסה המקורית.

  • בדיקת וריאציות שונות

    המאגר כולל גרסאות מהירות וגרסאות פיתוח לבדיקת ביצועים שונים באותה סביבה.

איפה זה נופל

המאגר הזה דורש התעסקות טכנית עם ComfyUI והרחבות צד שלישי, ולא מתאים למי שמחפש פתרון של קליק אחד או ממשק פשוט. יש כאן תלות במקדדי טקסט כבדים כמו Llama 3.1 ו־T5-XXL שצורכים המון זיכרון בפני עצמם. בנוסף, המודל מוגדר רשמית רק באנגלית, כך שפרומפטים בעברית לא יעבדו טוב בלי תרגום מקדים.

שאלות
נפוצות

אני צריך להוריד את כל ה־1.1 טרה-בייט כדי להתחיל לעבוד?

ממש לא. המאגר מכיל עשרות גרסאות כימות שונות, וריאציות מודל ומקדדים שונים. צריך לבחור רק את קובץ הדיפוזיה הרצוי, מקדדי הטקסט המתאימים וקובץ ה־VAE, ולהוריד רק אותם.

המודל תומך בהנחיות טקסט בעברית?

הכרטיס מציין תמיכה בשפה האנגלית בלבד. אם תכתבו פרומפטים בעברית התוצאות יהיו שגויות או לא צפויות, ולכן כדאי לתרגם את ההנחיות לאנגלית לפני השליחה למודל.

איך מריצים

כדי לעבוד איתו צריך ComfyUI מותקן יחד עם הרחבת gguf-node מעודכנת. ההתקנה ידנית, גוררים את קובץ המודל לתיקיית diffusion_models, את המקדדים השונים כמו t5xxl ו־llama לתיקיית text_encoders, ואת ה־VAE לתיקיית vae המתאימה. יש במאגר גם קובץ תהליך עבודה מוכן בפורמט JSON שאפשר לזרוק ישירות לממשק.

המאגר כולו שוקל 1.1 טרה-בייט בגלל עשרות קבצים וגרסאות, אז ברור שלא מורידים הכול אלא רק את הקבצים הספציפיים שמתאימים לרמת הדיוק שכרטיס המסך שלכם מסוגל להחזיק. אם אין לכם חומרה חזקה עם מספיק זיכרון וידאו לטעינת המודל והמקדדים הכבדים ביחד, הרצה מקומית כזו פשוט תזחל ועדיף לקרוא למודל דרך שירות ענן חיצוני.

ollama run hf.co/calcuis/hidream-gguf:Q6_K

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הקבצים

100 קבצים במאגר, 1.1 TB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הפרויקט מפורסם תחת רישיון MIT. הרישיון הזה מתיר שימוש מסחרי, שינוי קוד, הפצה וסגירת קוד כמעט בלי מגבלות, כל עוד משאירים את הצהרת זכויות היוצרים המקורית. אם אתם בונים שירות סביבו, מותר לכם להטמיע אותו במוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗