GPT
F

functiongemma-270m-it-GGUF

קוד פתוח

unslothgemma2025-12-18

  • transformers
  • gguf
  • gemma3
  • gemma
  • google

גרסת GGUF מכווצת של גוגל שמיועדת להפעלת קריאות פונקציה מקומית על מעבדים פשוטים. הוא מתאים למי שחייב לפרסר הוראות משתמש לקריאות API בלי לשלוח שום מידע לשרת חיצוני.

  • 5.9 GBמשקל הקבצים
  • 7,901הורדות בחודש
  • 95לייקים

מה זה

מדובר במודל שנגזר מארכיטקטורת Gemma 3 ואומן מראש על 6T טוקנים עם מיקוד ישיר במבני API והפעלת פונקציות. הוא לא מיועד לנהל שיחות חופשיות או לכתוב שירים, אלא לקבל הגדרת JSON schema, לקרוא טקסט מהמשתמש בתוך חלון של 32K טוקנים, ולפלוט קריאה מדויקת לכלי המתאים.

התוצאות שלו מראות בבירור את הפער בין משימות בסיסיות למורכבות. במבחן BFCL Simple הוא מגיע לציון של 61.6, אבל ברגע שהסביבה הופכת לחיה ומרובת קריאות במקביל, הציון ב־BFCL Live Parallel צונח ל־22.9. גוגל מציגים שיפור משמעותי לאחר אימון ייעודי, כאשר דיוק המודל במשימות מובייל קפץ מ־58% ל־85% אחרי התאמה למערך נתונים ספציפי.

מתאים ל

  • הפעלת פקודות מערכת במובייל

    תרגום פקודות כמו הדלקת פנס או יצירת אירוע לפונקציות מערכת מקומיות ללא רשת.

  • פירוק פקודות במשחקים

    המרה של קלט שחקן לפעולות לוגיות וקואורדינטות בתוך המשחק ישירות על החומרה.

  • ניתוב כלי עבודה מקומי

    זיהוי הפונקציה המתאימה מתוך סכמת JSON על מחשבים ניידים ללא צורך במעבד גרפי.

איפה זה נופל

גוגל מבהירים שהמודל לא מתאים לשמש כמודל שיחה רגיל. הוא מתקשה בהבנת דקויות שפה, סרקזם והוראות עמומות, וידע העולם שלו מוגבל לנתונים שנסגרו באוגוסט 2024. מעבר לכך, כל מבחני הבטיחות הרשמיים נערכו על קלטים באנגלית בלבד. אם תזינו לו פקודות בעברית או תבקשו ממנו להפעיל כמה כלים במקביל בלי אימון מקדים, שיעור השגיאות יהיה גבוה במיוחד.

שאלות
נפוצות

האם אפשר להשתמש בו ישירות לצ'אטבוט?

לא, המודל הזה לא נבנה לניהול שיחות. הוא מאומן לקבל סכמות של פונקציות ולפלוט קריאות מתאימות, כך ששימוש בו לצ'אט כללי יוביל לתוצאות גרועות.

האם הוא יעבוד בעברית ישר מהקופסה?

הערכות הבטיחות והביצועים של גוגל נעשו על הנחיות באנגלית בלבד. סביר להניח שקריאת פקודות בעברית תדרוש אימון נוסף כדי להגיע לרמת דיוק סבירה.

האם חייבים לאמן אותו לפני שימוש במוצר?

גוגל מציינים במפורש שהוא מיועד לשמש בסיס לאימון נוסף. במבחן המובייל שלהם הדיוק עלה מ־58% בגרסת הבסיס ל־85% לאחר התאמה אישית.

איך מריצים

המודל מגיע בקובצי GGUF במשקל כולל של 5.9 GB עבור כלל הקבצים שפרסמה unsloth. בבדיקות חומרה של גוגל על מעבד של מכשיר S25 Ultra עם LiteRT בארבעה תהליכונים, גרסת dynamic_int8 תפסה 288 MB של נפח אחסון ו־551 MB זיכרון עבודה, תוך הפקת 125.9 טוקנים בשנייה וזמן תגובה לטוקן ראשון של 0.3 שניות.

אם אתם צריכים רק לפרסר כמה פקודות מערכת פשוטות על מחשב נייד או טלפון, אפשר להריץ אותו מקומית בלי כרטיס מסך ייעודי. לעומת זאת, אם אתם בונים שירות ענן שצריך להתמודד עם שרשור כלים מסובך ומרובה שלבים, עדיף לפנות ישירות ל־API של מודל ענן גדול במקום לתחזק שרתים למודל המקומי.

ollama run hf.co/unsloth/functiongemma-270m-it-GGUF:Q4_K_M

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

המודל כפוף לרישיון gemma של גוגל ולתנאי השימוש ומדיניות השימושים האסורים שלהם. הרישיון מאפשר הפצה ושימוש לפיתוח, אך מחייב לעמוד במגבלות הבטיחות של גוגל ואינו מעניק חופש מוחלט כמו רישיונות קוד פתוח מתירניים.

  • שימוש מסחרי
  • שינוי הקוד
  • כפוף לתנאי השימוש של Google

הרישיון המלא בעמוד המודל ↗