GPT
O

osmosis-mcp-4b

קוד פתוח

osmosis-aiapache-2.02025-05-08

  • safetensors
  • gguf
  • qwen3
  • endpoints_compatible
  • conversational

גרסה מכווננת של Qwen3 שמתמחה בשרשור קריאות לפונקציות MCP. מתאים למי שרוצה סוכן מקומי קל שמעדיף כלים על פני ניחושים.

  • 4.4Bפרמטרים
  • 40,960טוקנים בהקשר
  • 55.9 GBמשקל הקבצים
  • 1,974הורדות בחודש

מה זה

מדובר במודל של 4.4 מיליארד פרמטרים שנבנה מעל Qwen3 ואומן באמצעות למידת חיזוק כדי להתמודד עם שרשור כלים בתקן MCP. הדגש כאן הוא לא על כתיבה יצירתית אלא על סוכנים שצריכים להפעיל כמה כלים ברצף, כמו בדיקת מזג אוויר ורק אז דירוג תוצאות, כדי לענות על בקשה אחת.

המפתחים השתמשו בשיטת Dr. GRPO ובנתונים סינתטיים מרובי שלבים. המטרה שלהם הייתה לשבור את הנטייה הרגילה של מודלים קטנים לנחש עובדות מתוך הזיכרון, ולגרום לו להעדיף קריאה אקטיבית לשרת הכלים בכל פעם שחסר לו מידע.

מתאים ל

  • סוכן מקומי לשרתי MCP

    חיבור ישיר לשרתי כלים שדורשים קריאות מרובות לפי תקן MCP.

  • אוטומציה פנימית של משימות

    ביצוע שאילתות מורכבות שמצריכות שליפת מידע מכמה מקורות ברצף.

  • בדיקת תרחישי Function Calling

    פיתוח ובדיקת שרתי כלים מקומיים בלי לשלם על API חיצוני יקר.

איפה זה נופל

הכרטיס לא מציג מדדי ביצועים מספריים או השוואות בנצ'מרק מסודרות מול מודלים אחרים. לא ברור איך הוא מתמודד עם עברית, והאימון שלו נשען כולו על נתונים סינתטיים ושרתי בדיקה מדומים. במקרים שבהם שרת ה־MCP מחזיר שגיאה לא צפויה או תשובה מורכבת במיוחד, המודל עלול להיתקע בלולאות ולא להגיע לפתרון.

שאלות
נפוצות

האם המודל מתאים לשיחה כללית?

לא. האימון שלו התמקד בהפעלת פונקציות וקריאה לכלים לפי תקן MCP, ולכן הוא לא הבחירה הנכונה לצ'אט כללי או לכתיבת תוכן.

כמה זיכרון דרוש כדי להריץ אותו?

הקבצים שוקלים 55.9 ג'יגה בייט בפורמט bfloat16, כך שתצטרכו מעבד גרפי חזק עם זיכרון ייעודי של 16 עד 24 ג'יגה לפחות להרצה סבירה, אלא אם תשתמשו בקוונטיזציה.

איך מריצים

המשקלים מגיעים בפורמט bfloat16 על פני 31 קבצים ששוקלים יחד 55.9 ג'יגה בייט. להרצה מקומית מלאה תצטרכו כרטיס מסך מודרני עם מספיק זיכרון כדי להחזיק את המודל ולפתוח הקשר רחב, במיוחד אם מנצלים את מלוא 40,960 הטוקנים שלו.

אם אין לכם חומרה ייעודית בשרת, להוריד 56 ג'יגה בייט בשביל מודל של 4B זה מהלך כבד. במקרה כזה עדיף לחכות לגרסאות מכווצות או לפנות למודלים סגורים דרך API.

ollama run hf.co/osmosis-ai/osmosis-mcp-4b:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

רישיון apache-2.0 מאפשר שימוש חופשי לחלוטין, כולל שימוש מסחרי, שינוי הקוד והפצה פנימית או בענן. התנאי העיקרי הוא שמירה על הודעת זכויות היוצרים והרישיון המקורי בקוד שלכם.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗