GPT
N

nai-anime-v2

קוד פתוח

NovelAIother2025-07-06

  • diffusers
  • safetensors
  • stable-diffusion
  • stable-diffusion-diffusers
  • text-to-image

יש כאן גם סקירה על NovelAI עצמו.

גרסת אנימה מבוססת SD1.5 ותיקה ששוחררה למחקר ולשימוש אישי. שווה לבדוק אותה בעיקר אם אתם מחפשים מודל קל יחסית שמייצר איורי אנימה ברזולוציית מגה פיקסל.

  • 860Mפרמטרים
  • 5.3 GBמשקל הקבצים
  • 318הורדות בחודש
  • 104לייקים

מה זה

מדובר במודל ישן של NovelAI שמבוסס על ארכיטקטורת Stable Diffusion 1.5, ומכוון ספציפית ליצירת תמונות בסגנון אנימה. בניגוד לגרסאות בסיס רגילות של אותה תקופה שנחנקו ברזולוציות גבוהות, הוא אומן לתמוך ברזולוציות של מגה פיקסל כמו 832 על 1216 או 1024 על 1024.

המשקלים שפורסמו מכילים רק את ה־Unet וה־VAE, בלי שאר הרכיבים הנלווים, כדי לחסוך מקום בקבצים. האימון שלו הסתמך על השכבה הלפני אחרונה של CLIP, ולכן הוא דורש הגדרת CLIP skip ספציפית כדי לקבל תוצאות מדויקות שמגיבות נכון להנחיות טקסטואליות מורכבות של סגנון אנימה.

מתאים ל

  • מחקר אישי באנימה

    מאפשר לבחון איך מודל SD1.5 מכוונן מתמודד עם רזולוציה של מגה פיקסל ואיורי דמויות.

  • יצירת דמויות להדמיה

    מתאים להפקת איורי קונספט בסגנון מנגה ואנימה במחשב המקומי ללא עלות שרת.

  • בדיקת ארכיטקטורת CLIP

    שימושי לבחינת השפעת חילוץ טקסט משכבות CLIP שונות על איכות התמונה הסופית.

איפה זה נופל

הקאץ' המרכזי הוא שההורדה לא מכילה חבילה שלמה שעובדת ישירות מהקופסה. תצטרכו להביא לבד את רכיבי המודל החסרים מגרסה 1.4 כדי להרים אותו, וקובץ ה־ckpt לא נבדק כלל. בנוסף, חובה לכוון ידנית את ה־CLIP skip לשתיים כדי למנוע עיוותים. הוא מיועד לסגנון אנימה מובהק ברזולוציות ספציפיות, ולא מתאים לתמונות ריאליסטיות או להפצה נקייה בלי הרכבה מוקדמת.

שאלות
נפוצות

למה המודל לא מציג תמונות טובות בהפעלה רגילה?

הוא אומן על השכבה הלפני אחרונה של CLIP. אם לא מגדירים CLIP skip שווה ל־2 בתוכנת ההרצה, הפענוח של הפרומפט נכשל והאיכות נפגעת דרמטית.

אפשר להוריד אותו ולהתחיל להריץ ישר מ־diffusers?

לא מיד. המאגר מציע רק את ה־Unet וה־VAE, ואת שאר הקבצים הנדרשים לצינור העבודה תצטרכו להעתיק מהמאגר של Stable Diffusion 1.4.

איך מריצים

כדי להריץ אותו עם diffusers תצטרכו להשלים קבצים חסרים מ־Stable Diffusion 1.4 המקורי, כי המאגר מציע רק Unet ו־VAE. יש גם קובץ ckpt שמצורף לנוחות, אבל המפתחים מציינים שהם לא בדקו את התקינות שלו. הגדרה קריטית בהרצה היא לקבוע ערך CLIP skip שווה ל־2 בתוכנת ה־inference שלכם, אחרת הפרומפט פשוט יתפרק.

מבחינת חומרה, קבצים בנפח של קצת מעל 5 גיגה־בייט ומודל של כ־860 מיליון פרמטרים רצים בנוחות על כרטיסי מסך ביתיים צנועים. אם אין לכם סביבה מקומית מוכנה עם רכיבי SD בסיסיים, אולי עדיף להשתמש בפתרונות ענן במקום להרכיב את חלקי המודל לבד.

from diffusers import DiffusionPipeline

pipe = DiffusionPipeline.from_pretrained("NovelAI/nai-anime-v2")
img = pipe("a photo").images[0]

הרישיון

הרישיון כאן מורכב ומשלב את CreativeML Open RAIL-M יחד עם CC BY-NC-SA 4.0 במקביל. המשמעות בפועל היא איסור מוחלט על שימוש מסחרי בגלל סעיף ה־NC, חובת שיתוף תחת אותו רישיון אם ביצעתם שינויים, ומגבלות השימוש הרגילות של ה־RAIL. בקיצור, רק לניסויים ומחקר עצמאי, לא למוצר שאתם מתכננים למכור.

הרישיון המלא בעמוד המודל ↗