GPT
W

wan-1.3b-gguf

קוד פתוח

calcuisapache-2.02025-03-14

  • gguf
  • gguf-node
  • gguf-connector
  • text-to-video
  • en

גרסת GGUF מכווצת למודל הווידאו של Wan בגודל 1.3 מיליארד פרמטרים. היא מאפשרת להפיק וידאו מטקסט או מתמונה מקומית בחומרה נגישה יחסית.

  • 72.9 GBמשקל הקבצים
  • 39,808הורדות בחודש
  • 43לייקים

מה זה

מדובר בהמרה של מודל הווידאו Wan 2.1 לפורמט GGUF, שמטרתה להקל על הריצה המקומית. המודל מייצר וידאו מטקסט, ובגרסת VACE הוא יודע לעבוד גם על תמונה לווידאו ווידאו לווידאו בלי להזדקק למודל Vision Clip נפרד. לפי התיאור של המפתח, גרסת ה־VACE הזו רצה מהר יותר משמעותית מגרסאות אחרות ומפשטת את שרשרת העבודה.

היתרון המרכזי כאן הוא היכולת להריץ מודל שלם בפורמט אחיד הכולל את מודל הדיפוזיה, מקודד הטקסט umt5 ומקודד הווידאו vae. זה פותר תסבוכות של סביבות עבודה כבדות ומאפשר לשלב אותו ישירות בכלים מוכרים.

מתאים ל

  • יצירת וידאו מטקסט מקומית

    מאפשר לייצר סרטונים קצרים מהנחיות טקסט באנגלית ישירות בתוך ComfyUI.

  • אנימציה לתמונה קיימת

    גרסת VACE מאפשרת לייצר וידאו מתמונה בלי להעמיס מודל ראייה נוסף בזיכרון.

  • עריכת וידאו לווידאו

    שינוי סגנון או עיבוד של סרטון קיים בסביבה מקומית בלי תלות ברשת.

איפה זה נופל

היוצר מזהיר במפורש מפני שגיאת זיכרון נגמר בריצה הראשונה של מקודד הטקסט umt5 בזמן בניית הטוקנייזר מחדש. הפתרון שלו הוא פשוט לשלוח את הבקשה פעם נוספת, מה שמראה שהתהליך אינו יציב לחלוטין. בנוסף, המודל מוגדר רשמית לאנגלית בלבד, כך שטקסט בעברית עלול לתת תוצאות לקויות או לא מובנות.

אותה משפחה

wan יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

למה המערכת זורקת שגיאת Out of Memory מיד בהרצה הראשונה?

בזמן יצירת הטוקנייזר של umt5 בריצה הראשונה צריכת הזיכרון קופצת. היוצר מציין שלא צריך להילחץ, ומספיק להריץ שוב את הפרומפט באותו הסשן כדי שזה יעבוד.

מה ההבדל בין גרסאות t2v לגרסאות vace?

גרסת t2v מיועדת בעיקר ליצירת וידאו מטקסט. גרסת vace תומכת גם בהנפשת תמונות וסרטונים, והיא רצה מהר יותר כי היא לא דורשת מודל vision clip נפרד.

איך מריצים

את המודל מריצים דרך ממשק פקודה ייעודי שנקרא gguf-connector או בתוך ComfyUI באמצעות תוספי gguf-node או comfyui-gguf. צריך לחלק את הקבצים לתיקיות הנכונות של מקודד הטקסט, הדיפוזיה וה־VAE. ישנן גרסאות שונות כמו q4_0 לחיסכון במשאבים ו־q8_0 לדיוק גבוה יותר.

אם אתם לא רוצים להתעסק עם שרשראות קומפי מורכבות, או שאין לכם כרטיס מסך שיכול לסחוב יצירת וידאו מקומית, עדיף להשתמש ב־API ענן ולא להוריד עשרות ג'יגה־בייטים של משקלים.

ollama run hf.co/calcuis/wan-1.3b-gguf:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הפרויקט מפורסם תחת רישיון apache-2.0. מותר להשתמש בו לצרכים מסחריים ופרטיים, לשנות את הקוד ולהפיץ אותו, כל עוד שומרים על הודעת זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗