GPT
D

DAN-L3-R1-8B

קוד פתוח

UnfilteredAIapache-2.02025-02-04

  • transformers
  • safetensors
  • gguf
  • llama
  • text-generation

גרסה נטולת הגנות של מודל שמונה מיליארד פרמטרים, שמיועדת למי שצריך תגובות גולמיות לחלוטין בלי סירובים. הבחירה בו מתאימה בעיקר לבדיקות עמידות ולמחקרי בטיחות של בינה מלאכותית.

  • 8Bפרמטרים
  • 131,072טוקנים בהקשר
  • 29.9 GBמשקל הקבצים
  • 3,063הורדות בחודש

מה זה

מדובר בהתאמה של המודל המזוקק DeepSeek-R1-Distill-Llama-8B, שעברה כוונון מיוחד במטרה למחוק כל מנגנון סינון או התאמה מוסרית. בזמן שרוב הפיתוחים בגודל הזה מנסים לעדן את הפלטים ולהימנע מעימותים, כאן אימנו אותו על שיחות רשת בוטות ודיאלוגים תוקפניים כדי לייצר דפוס פעולה שמתעלם מכללי בטיחות מקובלים.

הוא מיועד להפקה של טקסטים חופשיים, תוכן מבוגרים ותגובות ישירות שלא עוברות ריכוך, תוך שמירה על יכולות החשיבה הבסיסיות של מודל המקור באנגלית. במקום לבלום שאלות רגישות, הוא עונה בצורה גולמית ומחקה דפוסי כתיבה אגרסיביים, מה שמבדיל אותו מהפצות Llama סטנדרטיות שמסרבות לבקשות כאלה מיד.

מתאים ל

  • מחקרי בטיחות והגנה

    בדיקת גבולות של מודלים פתוחים וזיהוי תגובות קיצוניות בתנאי מעבדה מבוקרים.

  • בדיקות חסינות למערכות

    הזנת פלטים תוקפניים למסנני תוכן כדי לבחון יכולת חסימה של טקסט רעיל.

  • סימולציות דיאלוג קיצוני

    יצירת דמויות למשחקים או תרחישים שדורשים שפה מחוספסת ללא צנזורה מובנית.

איפה זה נופל

המודל פולט תוכן רעיל, פוגעני, קיצוני ומיני בלי שום מעצורים, כפי שמצהירים היוצרים שלו בפירוש. הוא אומן לפעול באנגלית בלבד, כך שאין טעם לצפות ממנו לעבודה תקינה בעברית. שילוב שלו במערכת שפונה ללקוחות או בסביבה שדורשת מהימנות עסקית יחשוף אתכם לפלטים לא הולמים, והוא חסר לחלוטין מנגנוני בקרה פנימיים.

שאלות
נפוצות

האם המודל מתאים ליישום שמשרת משתמשי קצה?

בשום אופן לא. המודל אומן להגיב באגרסיביות ולייצר תוכן בוטה, מה שיוביל מהר מאוד לפלטים פוגעניים מול לקוחות. הוא מתאים אך ורק לסביבות מחקר מבודדות.

האם אפשר להשתמש בו לטקסטים בעברית?

האימון והכוונון שלו נעשו באנגלית בלבד. הניסיון לפנות אליו בעברית יניב כנראה תגובות משובשות, ערבוב שפות או ירידה משמעותית באיכות הטקסט.

איך מריצים

כדי להעלות אותו לזיכרון בדיוק המקורי של bfloat16 תצטרכו כרטיס מסך עם לפחות עשרים וארבעה גיגה זיכרון, כמו RTX 3090 או כרטיס שרת מקביל. קבצי המשקולות תופסים כמעט שלושים גיגה בדיסק, כך שאי אפשר להריץ אותו בצורה הזו על מחשב נייד פשוט בלי לבצע קוונטיזציה לארבעה ביטים.

אם אין לכם חומרה מתאימה מקומית, עדיף להרים שרת ענן ייעודי לפי שעה עם כרטיס תואם ולהריץ אותו דרך ספריית transformers. מודלים מסוג כזה לא זמינים בשירותי API ציבוריים ומנוהלים בגלל אופי התוכן, כך שהרצה עצמאית היא האפשרות היחידה בפועל.

ollama run hf.co/UnfilteredAI/DAN-L3-R1-8B:F16

איזו גרסה

אותו מודל בכמה רמות דחיסה. ככל שהמספר נמוך יותר הקובץ קטן יותר ורץ על פחות זיכרון, והתשובות נהיות פחות מדויקות. רוב האנשים רוצים את הגדולה ביותר שנכנסת להם בזיכרון.

הרישיון

הרישיון הוא apache-2.0, שמתיר שימוש מסחרי, שינוי קוד והפצה מחדש כמעט בלי מגבלות, כל עוד מצרפים את כתב הוויתור על אחריות ואת הרישיון המקורי. למרות ההיתר המשפטי הגורף, היוצרים מבהירים שהאחריות לתוצאות השימוש מוטלת על המפעיל בלבד, ולכן הטמעה במוצר מסחרי דורשת מערכות סינון חיצוניות.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא בעמוד המודל ↗