GPT
W

Wan2.2-TI2V-5B-GGUF

קוד פתוח

QuantStackapache-2.02025-07-28

  • gguf
  • ti2v
  • text-to-video
  • en
  • zh

גרסה מכווצת של מודל וידאו של חמישה מיליארד פרמטרים. היא נועדה למי שרוצה ליצור וידאו מטקסט או מתמונה על חומרה ביתית במקום לשלם על שרתים יקרים.

  • 42.3 GBמשקל הקבצים
  • 72,812הורדות בחודש
  • 225לייקים

מה זה

מדובר בהמרה ישירה לפורמט GGUF של המודל Wan2.2-TI2V-5B מבית Wan-AI, שמיועד למשימות של יצירת וידאו מטקסט ומתמונה. הרעיון כאן הוא לקחת ארכיטקטורה של 5B פרמטרים ולדחוס אותה כדי שתוכל לרוץ ביעילות בסביבות עבודה מקומיות, בלי שתצטרכו להחזיק אשכול כרטיסי מסך באלפי דולרים.

בניגוד למודלי וידאו כבדים שדורשים משאבים מפלצתיים, הגודל הזה יושב בנקודה מעניינת שמאזנת בין דרישות זיכרון לבין יכולת יצירת תנועה סבירה. הוא יודע לעבוד עם הנחיות באנגלית ובסינית, ומתאים למי שרוצה לשלב יצירת קליפים קצרים ישירות מתוך סביבת עבודה קיימת.

מתאים ל

  • יצירת קליפים ב־ComfyUI

    הוא נתמך ישירות בתוסף ייעודי של ComfyUI ומאפשר לייצר וידאו מקומי מתמונות.

  • בדיקות ופיתוח מהיר

    בגודל 5B הוא מאפשר לבדוק תהליכי יצירת וידאו בלי להרים שרתי ענק.

  • אוטומציה מקומית לקריאייטיב

    מאפשר לייצר אנימציות קצרות מטקסט ומספק שליטה מלאה בנתונים בלי להוציא אותם החוצה.

איפה זה נופל

המודל מוגדר רשמית רק לאנגלית ולסינית, כך שפרומפטים בעברית לא יעבדו כאן כמו שצריך בלי תרגום מוקדם. חוץ מזה, הכרטיס מציין המרה ישירה בלי פרסום מדדים רשמיים על פגיעה באיכות התמונה בעקבות הקוונטיזציה, ולכן חובה לבדוק בעצמכם מריחות או ירידה בפרטים של התנועה לפני שבונים על זה למוצר.

שאלות
נפוצות

האם המודל תומך ביצירת וידאו מתוך תמונה קיימת?

כן, השם TI2V מעיד על יכולת יצירה גם מטקסט וגם מתמונה ישירות לווידאו. תצטרכו להזין את תמונת המקור בתוך ComfyUI לצד הפרומפט המתאים.

איך אפשר לעבוד איתו בעברית?

הוא אומן על אנגלית וסינית בלבד, כך שלא כדאי לכתוב לו הנחיות בעברית. הדרך היחידה היא לתרגם את הטקסט לאנגלית לפני ששולחים אותו למודל.

איך מריצים

את הקבצים מריצים מקומית דרך ComfyUI באמצעות התוסף ComfyUI-GGUF של city96. זורקים את הקובץ המתאים לתיקיית unet בתוך המערכת ומחברים אותו לתהליך העבודה שלכם.

סך כל הקבצים שוקל מעל 42 ג'יגה בייט, כך שתצטרכו כרטיס מסך מודרני עם כמות נאה של זיכרון כדי להחזיק את הקוונטיזציה הרצויה. אם אין לכם כרטיס מתאים או שאתם צריכים לרנדר סרטונים בקצב גבוה לאלפי משתמשים במקביל, עדיף לפנות לפתרון מנוהל בענן ולא להחזיק את זה על מחשב מקומי.

ollama run hf.co/QuantStack/Wan2.2-TI2V-5B-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0, שמתיר שימוש מסחרי חופשי, שינוי של הקוד והפצה פנימית או חיצונית בתוך מוצרים. עם זאת, היוצרים מציינים שכל תנאי השימוש וההגבלות המקוריות של מודל הבסיס נשארים בתוקף, ולכן יש לעמוד בהם ולצרף את עותק הרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗