GPT
D

deepreinforce-ai_Ornith-1.0-9B-GGUF

קוד פתוח

bartowskimit2026-06-25

  • gguf
  • image-text-to-text
  • endpoints_compatible
  • conversational

גרסת GGUF מכווצת למודל מולטימודלי של 9 מיליארד פרמטרים. היא מאפשרת לעבד תמונה וטקסט על חומרה מקומית רגילה בלי שרת ייעודי.

  • 143 GBמשקל הקבצים
  • 6,676הורדות בחודש
  • 41לייקים

מה זה

מדובר במודל שמקבל תמונה וטקסט ומחזיר טקסט, שעבר אופטימיזציה לפורמט GGUF באמצעות llama.cpp עם כיול imatrix. המקור שייך לצוות deepreinforce-ai, וברטובסקי ארז אותו מחדש בגרסאות משקל שונות, החל מקבצים כבדים של 17.92 גיגה בייט בפורמט מלא ועד גרסאות מכווצות של פחות מ־4 גיגה בייט.

המבנה של הפרומפט כולל בלוק מובנה של חשיבה בתשובת העוזר. זה מעיד שהמודל מאומן להוציא שלבי חשיבה לפני המענה הסופי. בנפח של 9 מיליארד פרמטרים, הוא מציע פתרון ראייה ממוחשבת וטקסט קומפקטי יחסית, שמתאים למשימות הבנה וניתוח תמונה מקומיות.

מתאים ל

  • ניתוח תמונות מקומי

    מאפשר לחלץ מידע מתמונות ומסמכים ישירות על המחשב, בלי לשלוח מידע רגיש לענן.

  • עוזר מקומי עם שלבי חשיבה

    מבנה הפרומפט מייצר שלבי חשיבה לפני התשובה, דבר שעוזר במענה על שאלות מורכבות.

  • פיתוח אפליקציות שולחניות

    במשקל 5.9 גיגה בייט הוא נכנס לכרטיסי מסך סטנדרטיים של מחשבים אישיים.

איפה זה נופל

הכרטיס לא מציג שום מדדי ביצועים, בנצ'מרקים או מבחני דיוק של מודל המקור על תמונות או טקסט, אלא רק נתוני מהירות טכניים של הרצה על מעבדי שרת. בנוסף, לא מצוין כמה טוב הוא מתמודד עם שפות אחרות מלבד אנגלית, כך שסביר להניח שהבנת עברית בתמונות או בטקסט תהיה מוגבלת או שבורה. חייבים לבדוק אותו עצמאית לפני שמשלבים אותו במערכת אמיתית.

אותה משפחה

deepreinforce-ai-Ornith-1.0 יצא ב־2 גרסאות שיש להן עמוד כאן. אלה האחרות, לפי כמה מורידים אותן.

שאלות
נפוצות

איזה קובץ להוריד מתוך הרשימה?

אם יש לכם כרטיס מסך עם 8 גיגה זיכרון, קחו את Q4_K_M או Q5_K_M שמציעים איכות טובה בלי לחנוק את החומרה. למחשבים חלשים יותר מומלץ לבדוק את IQ4_XS או גרסאות ה־Q3.

האם צריך להוריד את כל 29 הקבצים שבעמוד?

לא. המאגר כולל את כל רמות הכיווץ האפשריות, ואתם צריכים להוריד רק קובץ GGUF אחד שמתאים לזיכרון שלכם.

איך מריצים

בשביל להריץ אותו, מורידים קובץ ספציפי אחד ולא את כל המאגר. לרוב השימושים, קובץ כמו Q4_K_M ששוקל 5.91 גיגה בייט נותן איזון טוב, ואפשר להכניס אותו ישירות לכרטיס מסך עם 8 גיגה זיכרון. אם יש לכם פחות מזה או שאתם עובדים על מעבד, גרסאות כמו IQ3 או Q4_0 יתאימו יותר, והן כוללות תמיכה באריזה מחדש בזמן ריצה למעבדי ARM ו־AVX.

אפשר להריץ את הקבצים בכלים מוכרים כמו LM Studio, llama.cpp, koboldcpp או Jan AI. אם המחשב שלכם חלש מ־8 גיגה זיכרון או שאין לכם מאיץ גרפי סביר, חבל על הזמן של המעבד, ועדיף לשלוח בקשות לשרת חיצוני.

ollama run hf.co/bartowski/deepreinforce-ai_Ornith-1.0-9B-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא MIT. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו ולשלב אותו במוצרים סגורים, כל עוד שומרים על הודעת זכויות היוצרים המקורית.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש

הרישיון המלא בעמוד המודל ↗