GPT
G

Gemopus-4-26B-A4B-it-GGUF

קוד פתוח

Jackrongapache-2.02026-04-09

  • transformers
  • gguf
  • gemma4
  • image-text-to-text
  • llama.cpp

גרסת כוונון עדין למודל Gemma 4 26B שמתמקדת במבנה תשובות נקי ובניסוח טבעי. היא נועדה למי שרוצה חשיבה מבוקרת בלי שרשראות הסקה מנופחות או סגנון מתורגם ומעיק.

  • 262,144טוקנים בהקשר
  • 80.7 GBמשקל הקבצים
  • 939הורדות בחודש
  • 105לייקים

מה זה

הפרויקט הזה לוקח את מודל הבסיס של גוגל ומעביר אותו כוונון עדין בהנחיה ישירה, בלי הזיקוק האגרסיבי מ־Claude שנפוץ היום במודלים פתוחים. הרעיון כאן הוא לשמר את סגנון ההסקה המקורי של Gemma בלי להעמיס עליו מלל חשיבה מזויף שלא באמת תורם לפתרון הבעיה.

התוצאה בפועל מתרכזת בשיפור הפלט הסופי. הכותב ניקה את הטון הנוקשה של מודל המקור, שיפר את השימוש בתחביר Markdown ליצירת מבנה היררכי ברור, והפך את ההסברים הטכניים לענייניים ומדויקים יותר. המודל שומר על חלון הקשר של 262,144 טוקנים ותומך בקלט תמונה וטקסט בשפות אנגלית, סינית, קוריאנית ויפנית.

מתאים ל

  • סיכום וארגון מסמכים טכניים

    המודל כוונן לייצר מבנה היררכי מסודר בפורמט Markdown בלי מריחות מיותרות.

  • סיוע בכתיבת קוד מקומי

    מתאים לשאלות תכנות יומיומיות בזכות ניסוח הסברים ענייני וחלון הקשר רחב.

  • ניתוח משולב של תמונה וטקסט

    תומך בקלט ויזואלי ומחזיר ניתוח מובנה וברור בארבע השפות הנתמכות.

איפה זה נופל

היוצר עצמו מצהיר שהמודל הוא ניסוי הנדסי ולא פתרון מוכן לייצור, וממליץ לפנות לסדרת Qwopus למשימות קריטיות. הפעלת כלים חיצוניים סובלת מתקלות תאימות קשות בסביבות כמו llama.cpp או LM Studio, כולל כניסה ללולאות אינסופיות ושגיאות פורמט. בנוסף, יכולות ההסקה המתמטית והידע הכללי מוגבלים ביחס למודלי ענק, ובבעיות מורכבות או בתחומים נידחים הוא עלול להמציא עובדות ולאבד את קו המחשבה.

שאלות
נפוצות

האם המודל מתאים לעבודה שוטפת בעברית?

המודל מצהיר על תמיכה באנגלית, סינית, קוריאנית ויפנית בלבד. הוא לא אומן או נבדק ספציפית בעברית, ולכן לא מומלץ להסתמך עליו למשימות בשפה זו.

אפשר להשתמש בו ישירות בסוכן חכם שמפעיל כלים?

עדיף שלא בשלב הזה. קיימות בעיות תאימות ידועות בהפעלת פונקציות וכלים בסביבות הרצה מקומיות, שמובילות לפורמט שגוי או ללולאות תקועות.

למה היוצר ממליץ על סדרת Qwopus במקום המודל הזה?

ארכיטקטורת Gemma 4 מציגה תנודתיות רבה בכוונון עדין וחסרונות מובנים ביחס לסדרת Qwen. המודל הנוכחי מוגדר כניסוי מתודולוגי, בזמן שסדרת Qwopus יציבה ובוגרת יותר.

איך מריצים

המשקל הכולל של הקבצים מגיע ל־80.7 גיגה־בייט בתשעה קבצים בפורמט bfloat16. כדי להריץ את הגרסה המלאה הזו מקומית תצטרכו מערך של כמה כרטיסי מסך חזקים או שרת ייעודי עם מספיק זיכרון VRAM.

בזמן הריצה מגדירים temperature של 1.0, ערך top_p של 0.95 ו־top_k של 64. מצב החשיבה מופעל על ידי הטוקן הייעודי בתוך הפרומפט, וכשמכבים אותו המודל מייצר בלוק מחשבה ריק וממשיך לתשובה. אם אין לכם חומרה כבדה או שאתם מחפשים יציבות מוכחת לפרודקשן, קריאה ל־API של מודל ענן חזק תחסוך כאבי ראש.

ollama run hf.co/Jackrong/Gemopus-4-26B-A4B-it-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא Apache 2.0. מותר להשתמש בו לצרכים מסחריים, לשנות אותו, להפיץ אותו ולשלב אותו בקוד סגור, כל עוד שומרים על הודעות זכויות היוצרים והרישיון המקורי ואינכם מטילים אחריות משפטית על היוצר.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗