GPT
N

nomos-1

קוד פתוח

NousResearchapache-2.02025-12-07

  • transformers
  • safetensors
  • qwen3_moe
  • text-generation
  • conversational

התמחות ייעודית בפתרון בעיות מתמטיות וכתיבת הוכחות בשפה טבעית. הוא מתאים למי שמחפש יכולות הסקה מתמטית גבוהות על בסיס ארכיטקטורת תערובת מומחים.

  • 31Bפרמטרים
  • 262,144טוקנים בהקשר
  • 114 GBמשקל הקבצים
  • 389הורדות בחודש

מה זה

מדובר במודל שפותח בשיתוף פעולה בין NousResearch לבין Hillclimb AI, והוא מבוסס על Qwen3-30B-A3B-Thinking-2507. המטרה המרכזית שלו היא ביצועים במתמטיקה מתקדמת, וכדי להוציא ממנו את המקסימום המפתחים בנו סביבו מעטפת חשיבה ייעודית בשם Nomos Reasoning Harness.

ההבדל בביצועים ניכר במבחן פוטנם לשנת 2025. כשהוא רץ יחד עם מעטפת ההסקה, הוא הגיע לציון של 87 מתוך 120, בזמן שמודל הבסיס של קוון הגיע לציון 24 בלבד תחת אותם תנאים בדיוק. הפער הזה ממחיש שהכוונון כאן ממוקד בשיטות פתרון וניסוח הוכחות, ולא סתם שיפור כללי.

מתאים ל

  • פתרון בעיות מתמטיות

    הוא הגיע לתוצאה של 87 מתוך 120 במבחן פוטנם 2025 בעזרת מעטפת ההסקה.

  • כתיבת הוכחות מתמטיות

    האימון כוונן ספציפית לניסוח צעדי הוכחה והסקה בשפה טבעית.

  • מחקר אלגוריתמי והסקה

    מתאים למי שבוחן ארכיטקטורות MoE ומעטפות חשיבה מבוססות קוד פתוח.

איפה זה נופל

המודל הזה אינו כלי רב־תכליתי לצ'אט או לכתיבה כללית. התוצאות החזקות שלו תועדו רק בשילוב מעטפת ההסקה החיצונית של Nomos, כך שהרצה שלו כמודל שפה רגיל כנראה לא תספק את אותם ביצועים. אין בתיעוד שום מידע על יכולות בשפות שאינן אנגלית, ובפרט אין נתונים על עברית, כך שלא כדאי לבנות עליו למשימות שאינן מתמטיקה טהורה.

שאלות
נפוצות

האם אפשר להריץ אותו על מחשב מקומי עם כרטיס מסך אחד?

לא. משקל הקבצים הוא 114 גיגה בייט וההמלצה הרשמית היא הרצה בפיצול של שמונה מאיצים גרפיים באמצעות vLLM או SGLang.

האם כדאי להגדיר לו הנחיית מערכת לפני ששואלים שאלה?

היוצרים ממליצים במפורש להשתמש בו ללא הנחיית מערכת כדי לקבל את הביצועים המיטביים.

איך מריצים

כדי להריץ אותו מקומית צריך שרת רציני מאוד. הקבצים שוקלים 114 גיגה בייט בפורמט bfloat16, והתיעוד ממליץ להרים שרת באמצעות vLLM או SGLang בחלוקה לרוחב שמונה כרטיסי מסך, כלומר tensor-parallel-size 8. חומרה ביתית רגילה פשוט לא תספיק כאן.

אם אין לכם אשכול שרתים ייעודי עם מעבדים גרפיים מתאימים, עדיף לחכות לגישה דרך ספק ענן או API. בנוסף, המפתחים ממליצים במפורש לא להשתמש ב־system prompt בזמן ההרצה.

from transformers import pipeline

pipe = pipeline("text-generation", model="NousResearch/nomos-1")
print(pipe("שלום"))

הרישיון

הרישיון הוא Apache 2.0. מדובר ברישיון קוד פתוח מתירני שמאפשר שימוש מסחרי, שינוי של הקוד והפצה חופשית, בתנאי ששומרים על הודעות זכויות היוצרים והרישיון המקורי.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗