GPT
1

10Eros-Max-GGUF

קוד פתוח

Abirayother2026-08-10

  • gguf
  • text-to-video
  • image-text-to-video
  • image-to-video
  • comfyui

גרסת קוונטיזציה של שילוב ניסיוני בין מודלי וידאו ותמונה על בסיס MiniMax H3. היא מביאה מודל כבד מאוד לחומרת צרכנים עם 12 עד 24 גיגה זיכרון גרפי.

  • 67.9 GBמשקל הקבצים
  • 16,100הורדות בחודש
  • 38לייקים

מה זה

המאגר מכיל קובצי GGUF של 10Eros-Max, ניסוי של TenStrip שממזג משקלים של ארבעה מודלים שונים לתוך הארכיטקטורה של MiniMax H3. השילוב כולל שני מודלי וידאו, LTX 2.3 ו־Wan 2.2, וכן מודל תמונה אחד, Krea 2. המיזוג בוצע במתמטיקה של היטל אורתוגונלי, שמוסיפה מאפיינים לכיוונים שבהם המודל הבסיסי כמעט לא השתמש, במטרה להשפיע על המראה והתנועה בלי לשבור עקביות של זמן או מודלי אודיו.

בגרסתו המקורית המודל שוקל יותר מ־40 גיגה ודורש משאבים כבדים. ההסבה ל־GGUF מאפשרת להריץ את הטרנספורמר במידות דיוק שונות, החל מגרסת Q3_K_M של 8.9 גיגה ועד Q8_0 שמגיעה ל־21.6 גיגה. כל הגרסאות נועדו לשמור על היכולת של הבסיס לייצר וידאו יחד עם שמע, תוך שימוש במאפיינים שנלקחו מהמודלים האחרים.

מתאים ל

  • יצירת וידאו עם אודיו מקומית

    הרצת מודל MiniMax H3 עם שכבות סגנון נוספות ישירות על גבי כרטיסי מסך ביתיים ב־ComfyUI.

  • בדיקת מיזוגי מודלים

    מחקר והתנסות מעשית בשילוב משקלים אורתוגונלי בין מודלי תמונה ווידאו שונים.

  • הפקת וידאו בכרטיסי 16GB

    שימוש בגרסת Q4_K_M לקבלת תנועה ומראה ייחודיים בחומרה של 16 גיגה זיכרון.

איפה זה נופל

מדובר בבדיקה ניסיונית מובהקת של מיזוג משקלים בין ארכיטקטורות שונות, ולא במודל שעבר אימון מסודר מקצה לקצה. למרות הניסיון לשמור על עקביות בעזרת היטל אורתוגונלי, שילוב של מודל תמונה בתוך מודל וידאו הוא עניין רגיש שעלול להכניס ארטיפקטים.

מעבר לכך, הקובץ מוריד רק את הטרנספורמר הראשי. אתם עדיין צריכים לפנות מספיק זיכרון בשביל ה־VAE ומקודד הטקסט Qwen3-VL-32B, כך שהדרישות בפועל גבוהות ממשקל הקובץ לבדו.

שאלות
נפוצות

האם קובץ ה־GGUF כולל את כל מה שצריך כדי לייצר וידאו?

לא. הקובץ מכיל רק את ליבת הטרנספורמר. כדי לעבוד איתו צריך להוריד בנפרד את מקודד הטקסט Qwen3-VL-32B ואת ה־VAE של MiniMax לפענוח.

איזו גרסה מומלץ להוריד לכרטיס מסך עם 16GB VRAM?

גרסת Q4_K_M ששוקלת 11.6 גיגה או Q5_K_M ששוקלת 14.1 גיגה. הן מאזנות בין איכות התמונה לבין מקום פנוי בזיכרון למקודד הטקסט ול־VAE.

אפשר להשתמש במודל הזה בפרויקט מסחרי?

זה מורכב ומסוכן משפטית. המודל מערבב משקלים של ארבעה מודלים שונים, ולכן חלים עליו במקביל תנאי רישיונות הקהילה של MiniMax, Wan, LTX ו־Krea.

איך מריצים

ההרצה נעשית מקומית ב־ComfyUI בעזרת התוסף ComfyUI-GGUF, כאשר טוענים את קובץ המודל דרך צומת Unet Loader מתאים. חוץ מקובץ הווידאו עצמו, צריך לטעון בנפרד את המקודד הטקסטואלי של Qwen3-VL-32B בגרסת H3 ואת ה־VAE של MiniMax לפענוח התוצר.

מבחינת חומרה, כרטיסי 10 או 12 גיגה כמו RTX 3060 או 4060 יכולים לסחוב רק את Q3_K_M. לכרטיסי 16 גיגה כמו RTX 4070 ו־4080 מתאימות גרסאות Q4_K_M או Q5_K_M. מי שמחזיק RTX 3090, 4090 או מעבדי Apple Silicon עם 24 גיגה ומעלה יכול להריץ את Q6_K או את Q8_0 המלאה.

ollama run hf.co/Abiray/10Eros-Max-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון מוגדר בתור other. בפועל חל עליו רישיון הקהילה של MiniMax H3, אך בגלל המיזוג חלים גם תנאי הרישיונות של LTX 2.3, Wan 2.2 ו־Krea 2 על החלקים שהגיעו מהם. תסבוכת הזכויות הזו הופכת שילוב של המודל במוצר מסחרי לבעייתי מאוד מבחינה משפטית.

הרישיון המלא בעמוד המודל ↗