GPT
L

llama-3.2-reasoning-webgpu

רץ בדפדפן

webml-communityapache-2.02025-01-09

  • static

הדגמה שמריצה מודל שפה קטן מסדרת Llama 3.2 ישירות בתוך הדפדפן עם תמיכה ביכולות חשיבה. היא מתאימה למפתחים ולסקרנים שרוצים לבדוק ביצועי AI מקומיים על המחשב שלהם בלי שרת חיצוני.

  • הורדות בחודש
  • 231לייקים

מה זה

מדובר בממשק שבו מקלידים שאלות ומקבלים תשובות שמשלבות תהליכי חשיבה והסקה, ישירות ממודל Llama 3.2. הייחוד כאן הוא שאין שרת מאחורי הקלעים שמקבל את הטקסט שלכם. הכל מתבצע בצד הלקוח בעזרת טכנולוגיית WebGPU וספריית transformers.js.

הקוד הוא דף סטטי שמוריד את קובצי המודל ישירות למכשיר שלכם ומפעיל את המעבד הגרפי המקומי. אין כאן מנגנון מורכב של ענן, אלא ניצול ישיר של החומרה שנמצאת אצלכם במחשב כדי לפענח את הטקסט, לנתח את השאלה ולייצר את שלבי ההסקה בלי לשלוח פניות רשת החוצה.

מתאים ל

  • ניסוי WebGPU בדפדפן

    בדיקה מהירה של יכולות עיבוד בינה מלאכותית מקומית על המחשב שלכם בלי שום התקנה מוקדמת.

  • פיתוח אפליקציות פרטיות

    שימוש בקוד המקור כבסיס לפרויקטים שבהם המידע חייב להישאר אצל המשתמש ולא לעבור בענן.

  • הסקה לוגית בסיסית

    הרצת שאלות שדורשות צעדי מחשבה מובנים ישירות מתוך הדפדפן, בחינם ובלי תלות ברשת.

איפה זה נופל

האפליקציה דורשת דפדפן וחומרה עם תמיכה תקינה ב־WebGPU, ובלי זה היא פשוט לא תעבוד. בנוסף, מדובר בגרסה קטנה של Llama 3.2 כדי שתוכל להיכנס לזיכרון הדפדפן, אז אל תצפו ליכולות ניתוח מורכבות או לאמינות של המודלים הגדולים בענן. אין כאן שום מנגנון תיקון אם המודל מנחש שטויות.

שאלות
נפוצות

האם השימוש עולה כסף?

לא, הגישה חופשית לגמרי ואין צורך במנוי או בתשלום. הכל רץ על המשאבים של המחשב שלכם בלבד. אין כאן חיובים נסתרים או מכסות שימוש.

מה קורה לטקסט שאני מקליד?

הטקסט נשאר כולו בדפדפן המקומי שלכם ומעובד שם בלבד. שום מילה אינה מועברת לשרת מרוחק, כך שהפרטיות מוחלטת. זה אחד היתרונות של הרצה מקומית.

האם אפשר להריץ את זה מקומית אצלי?

כן, אפשר לשכפל את המאגר מגיטהאב, להתקין תלויות בעזרת npm ולהרים שרת פיתוח מקומי. ההוראות המדויקות מופיעות בקובץ התיעוד של הפרויקט. התהליך לוקח שתי דקות.

במה זה שונה משימוש רגיל ב־Llama 3.2?

ההבדל העיקרי הוא המיקום שבו החישוב מתבצע, ישירות בכרטיס המסך שלכם במקום בחוות שרתים. בגלל מגבלות הדפדפן והחומרה, נעשה שימוש בגרסה קטנה יותר של המודל. זה חוסך תלות ברשת אבל מגיע עם פשרות בביצועים.

איך משתמשים

טוענים את העמוד בדפדפן שתומך ב־WebGPU וממתינים להורדת משקלי המודל למחשב. אין צורך לפתוח חשבון, אין תור ואין הגבלת שימוש של שרת חיצוני. מהירות התגובה תלויה לחלוטין במעבד הגרפי של המחשב שלכם, כך שעל מחשב חזק המודל יגיב מהר ועל חומרה חלשה תרגישו האטה ברורה.

הרישיון

הפרויקט מפורסם ברישיון apache-2.0 קוד פתוח שמתיר שימוש, שינוי והפצה, כולל שימוש מסחרי. המידע שאתם מקלידים נשאר כולו בדפדפן המקומי שלכם, כך ששום תוכן אינו נשלח לשרת חיצוני או נשמר במאגר כלשהו.

  • שימוש מסחרי
  • שינוי הקוד
  • הפצה מחדש
  • שימוש בפטנטים

הרישיון המלא ב־Hugging Face ↗