GPT
O

omnigen2-gguf

קוד פתוח

calcuisapache-2.02025-06-26

  • gguf
  • gguf-node
  • any-to-any

גרסת GGUF מכווצת למודל OmniGen2 שנועדה להרצה ישירה בתוך ComfyUI. היא מאפשרת לייצר ולערוך תמונות בלי להסתבך עם קובצי safetensors כבדים.

  • 115 GBמשקל הקבצים
  • 1,320הורדות בחודש
  • 38לייקים

מה זה

מדובר בהמרה של מודל המולטימודל OmniGen2 לפורמט GGUF, שכוללת את מודל הדיפיוז'ן עצמו, מקודד הטקסט והתמונה Qwen2.5-VL-3B, ורכיב ה־VAE שנקרא כאן pig. המטרה העיקרית של המבנה הזה היא להריץ את כל הצינור בפורמט אחיד דרך צומת gguf-node ב־ComfyUI, בלי לפצל סוגי קבצים שונים לכל שלב.

המודל מיועד למשימות של טקסט לתמונה, תמונה לתמונה ועריכת תמונות. לפי הנתונים שהמפתח ציין, יצירת תמונה מטקסט מהירה פי 3 עד פי 5 בהשוואה לפעולות של תמונה לתמונה או עריכה, כך שמי שבונה עליו לפוטומניפולציה כבדה ירגיש את ההבדל בזמני הריצה.

מתאים ל

  • יצירת תמונות מטקסט

    מתאים למי שרוצה תמונות ב־ComfyUI במהירות גבוהה משמעותית מעריכת תמונה.

  • עריכת תמונות מונחית טקסט

    עובד במשימות תמונה לתמונה כשמוכנים לספוג זמני עיבוד ארוכים יותר.

  • הרצה מקומית חסכונית

    אידיאלי לעבודה עם כרטיסי מסך ביתיים תחת סביבת GGUF ייעודית.

איפה זה נופל

הבעיה הבולטת ביותר היא האיטיות בעבודה מבוססת תמונה, שם הביצועים צונחים לפי חמש ביחס ליצירת תמונה נקייה מטקסט. בנוסף, מדובר במבנה מרובה רכיבים שמחייב חיבור ידני של מקודד נפרד ו־VAE, ולא בקובץ יחיד שפשוט טוענים ומריצים. אם הצינור ב־ComfyUI לא מוגדר במדויק מול gguf-node, המערכת תיכשל.

שאלות
נפוצות

האם צריך להוריד את כל 115 הגיגהבייט של הריפוזמי?

לא. הריפו מכיל מספר קבצים וכימותים שונים. אתם בוחרים ומורידים רק את קובץ המודל הרצוי, מקודד אחד ו־VAE.

איך טוענים את מקודד ה־fp8 אם הוא לא GGUF?

טוען ה־GGUF ב־gguf-node תומך ישירות גם בגרסת fp8 safetensors מותאמת, כך שאין צורך להחליף צומת מיוחד ב־ComfyUI.

איך מריצים

כדי להריץ אותו זורקים את הקבצים לתיקיות המתאימות ב־ComfyUI: המודל הראשי ל־diffusion_models, המקודד ל־text_encoders, וה־VAE לתיקיית vae. הריפו כולל 34 קבצים בנפח כולל של 115 גיגהבייט, אבל מורידים רק את המשקלים והכימות הספציפיים שמתאימים לזיכרון שלכם.

הסביבה דורשת התקנה של gguf-node כדי לפענח את הקבצים. אפשר להשתמש במקודד GGUF או בגרסת safetensors של fp8 שתואמת לאותו טוען, וזה חוסך תעבורת זיכרון משמעותית בכרטיסים ביתיים.

ollama run hf.co/calcuis/omnigen2-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות את הקוד ולהפיץ אותו מחדש, כל עוד שומרים על הודעות זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗