GPT
W

wan22_i2v_14b_orbit_shot_lora

קוד פתוח

ostrisapache-2.02025-08-20

  • diffusers
  • text-to-image
  • lora

המודל מוסיף תנועת מצלמה מעגלית סביב אובייקט עבור מודל הווידאו Wan 2.2 של 14 מיליארד פרמטרים. אם חסרה לכם תנועת הקפה מוגדרת ביצירת סרטונים מתמונה, הוא פותר בדיוק את זה.

  • 297 MBמשקל הקבצים
  • 1,941הורדות בחודש
  • 73לייקים

מה זה

מדובר במשקולות LoRA קלות משקל שנוצרו באמצעות AI Toolkit, ומיועדות לשילוב על גבי מודל הבסיס Wan 2.2 I2V 14B דרך diffusers. המטרה כאן ממוקדת לחלוטין, ללמד את מודל התמונה לווידאו לבצע צילום שמקיף את האובייקט בסיבוב מלא.

המשקולות עצמן שוקלות רק 297 מגה בייט בחמישה קבצים, כך שלא מדובר במודל שלם אלא בתוספת קטנה שמתלבשת על מודל כבד בהרבה. היוצר אימן אותו תוך כדי סרטון הדרכה, מה שאומר שלא מדובר בהכרח במוצר שנבדק לעומק בכל תרחיש אפשרי, אלא בהדגמה ממוקדת של יכולת ספציפית דרך מילת הפעלה ייעודית.

מתאים ל

  • צילום מוצר בתלת ממד

    יצירת סיבוב מלא סביב פריט מתוך תמונה בודדת עבור הדגמות קטלוג או חנויות אונליין.

  • תנועת מצלמה בקולנוע

    הוספת תנועת מסלול מעגלית סביב דמות או מוקד עניין בסצנות וידאו מבוססות בינה מלאכותית.

  • לימוד אימון מתקדם

    בחינת משקולות כחלק מהמדריך של AI Toolkit ללמידה על תהליך אימון של מודלי וידאו.

איפה זה נופל

המודל אומן כחלק מהקלטת מדריך יוטיוב ולא כמוצר סגור לאנטרפרייז, ולכן אין שום נתוני בנצ'מרק או תיעוד ביצועים בכרטיס המודל. מעבר לזה, המודל מחייב שימוש במילת הטריגר המדויקת orbit 360 בפרומפט, ואם תשכחו אותה לא תקבלו את התוצאה המבוקשת. אי אפשר לדעת מראש איך הוא מתמודד עם תמונות מקור מורכבות, זוויות צילום חריגות או רקעים עמוסים עד שלא מנסים בפועל.

שאלות
נפוצות

האם אפשר להריץ את המודל הזה עצמאית בלי מודל הבסיס?

לא. מדובר בקובץ LoRA שרק מכוונן מודל קיים. אתם חייבים להתקין ולהריץ קודם כל את מודל הבסיס Wan 2.2 I2V 14B, ולטעון את השכבה הזו מעליו באמצעות diffusers.

איך גורמים למודל לבצע את סיבוב המצלמה?

חייבים להכניס את מילת ההפעלה orbit 360 לפרומפט הטקסטואלי שמלווה את התמונה. ללא הביטוי הזה, המודל לא יפעיל את ההתנהגות שנלמדה באימון.

איך מריצים

הקבצים עצמם קטנים מאוד ותופסים פחות מ־300 מגה בייט, אבל הם לא רצים לבד. אתם חייבים לטעון אותם יחד עם מודל הבסיס של 14B, שמחייב כרטיס מסך חזק מאוד עם שפע של זיכרון VRAM כדי לייצר פריימים של וידאו בקצב סביר.

אם אין לכם תחנת עבודה ייעודית או שרת עם GPU מתאים, תתקשו להריץ את מודל הבסיס מקומית. במקרים כאלה עדיף לחפש שירותי ענן שמאפשרים להעלות משקולות LoRA עצמאיות לתשתית שלהם.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("ostris/wan22_i2v_14b_orbit_shot_lora")
img = pipe("a photo").images[0]

הקבצים

5 קבצים במאגר, 297 MB סך הכול. הקישורים מובילים ישירות ל־Hugging Face.

הרישיון

הרישיון הוא apache-2.0, וזה אומר שאתם חופשיים לחלוטין להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו מחדש או לשלב אותו בתוך מוצר שלכם. התנאי היחיד הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי, בלי אחריות מצד היוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗