GPT
Q

Qwen-Image-2512-Turbo-LoRA

קוד פתוח

Wuli-artapache-2.02025-12-30

  • diffusers
  • Qwen
  • distillation
  • lora
  • text-to-image

מתאם LoRA שמאיץ יצירת תמונות מבוססת מודל הבסיס של Qwen פי עשרים. הוא מפיק תמונה בארבעה עד שמונה צעדים בלבד, במקום ארבעים צעדים מלאים.

  • 4.4 GBמשקל הקבצים
  • 5,234הורדות בחודש
  • 225לייקים

מה זה

התוסף הזה מתלבש על Qwen Image 2512 ומקצר את זמן היצירה בצורה משמעותית. המפתחים משתמשים בזיקוק CFG שנותן לבדו הכפלת מהירות, יחד עם צמצום של מספר צעדי הדגימה מארבעים לארבעה או שמונה צעדים. במבחן המעשי, הטענה של היוצרים היא קבלת אותה רמת פלט בביצועים מהירים פי עשרים, כאשר באתר ההדגמה בסין המערכת מדווחת על הפקת ארבע תמונות ברזולוציית 2k בתוך חמש שניות.

בניגוד להרצה רגילה שדורשת המון כוח חישוב וזמן יקר לכל פריים, כאן אפשר לעבוד ברינדור זריז בלי לאבד את היכולת להציג טקסט או סצנות מורכבות. שוחררו כבר שלוש גרסאות למתאם, כאשר גרסאות שתיים ושלוש מתמקדות בשיפור הצבעים והפרטים העדינים. המודל מתמקד באנגלית ובסינית, ושומר על דיוק סביר בטקסטים שמופיעים בתוך התמונה, כמו כותרות ספרים או בועות דיבור בקומיקס.

מתאים ל

  • רינדור קומיקס ואיורים

    מאפשר לייצר פאנלים מרובים עם בועות טקסט בסינית או באנגלית במהירות של שניות בודדות לכל עמוד.

  • עיצוב מוצר והדמיות תלת מימד

    מפיק הדמיות מבודדות עם טקסט מדויק על מקשים או אריזות, בנפח עבודה מהיר שלא תוקע את התהליך.

  • תצוגות מקדימות למשתמשים

    מתאים לשילוב בתוך יישום שצריך להחזיר תמונות ברזולוציה גבוהה כמעט בזמן אמת ללא זמני המתנה כבדים.

איפה זה נופל

החיסרון המרכזי שמתועד מראש הוא ירידה באיכות התמונה כשמנסים לייצר פרטים מורכבים במיוחד. בארבעה צעדים בלבד המודל נוטה לאבד חדות באזורים עמוסים, והפתרון שהיוצרים מציעים הוא להעלות ידנית את מספר הצעדים, מה שפוגע ברווח המהירות. בנוסף, הוא מיועד לשפות אנגלית וסינית, כך שפרומפטים בעברית או טקסט מקומי בתוך התמונה לא יניבו תוצאות טובות בלי תרגום מקדים.

שאלות
נפוצות

האם המתאם הזה פועל לבד כמודל עצמאי?

לא. מדובר במשקלי LoRA שחייבים להיטען על גבי מודל הבסיס Qwen-Image-2512. אתם זקוקים למשאבי החומרה שדורש מודל הבסיס כדי להריץ את הכל יחד.

באיזו גרסה של הקבצים כדאי להשתמש?

גרסה 3.0 היא העדכנית ביותר. היא שוחררה בינואר 2026 עם שיפורים ברמת הצבעים והפרטים, וכוללת תמיכה מובנית בעבודה עם ממשק ComfyUI.

איך מריצים

המשקל הכולל של הקבצים עומד על 4.4 גיגה בייט בשבעה קבצים, וההרצה נשענת על ספריית diffusers או על DiffSynth-Engine. המתאם תואם לשימוש בתוך ComfyUI החל מגרסה אחת ועד שלוש, כך שמי שכבר מריץ פייפליין מקומי יכול פשוט לחבר את הצומת למודל הבסיס.

היות שמדובר רק בשכבת מתאם ולא במודל עצמאי, צריך לטעון קודם את Qwen-Image-2512 השלם. המשמעות היא שאתם עדיין חייבים כרטיס מסך חזק שמסוגל להחזיק את מודל הבסיס בזיכרון ה־VRAM. ההבדל הגרפי בין ארבעה לשמונה צעדים זניח ברוב המקרים, אבל שמונה צעדים מייצבים פרטים קשים.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("Wuli-art/Qwen-Image-2512-Turbo-LoRA")
img = pipe("a photo").images[0]

הרישיון

הרישיון הוא Apache 2.0. זהו רישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה חופשית של תוצרים או מערכות מבוססות עליו. התנאי היחיד הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקבצים שמפיצים הלאה.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗