GPT

מודלים ותשתית · קוד פתוח

הלוגו של TruLens for LLMs

TruLens for LLMs

הקוד הפתוח הזה מיועד לניטור ובדיקה של סוכני בינה מלאכותית ומערכות שליפת מידע. במקום לנחש למה הסוכן החזיר תשובה שגויה, הוא מפרק את הריצה למקטעים ומודד זמנים, טוקנים ועלויות מדויקות בכל שלב.

ההבדל העיקרי מול פתרונות ניטור אחרים מגיע ממנגנוני השיפוט המובנים שלו, שמגיעים עם ציונים מנומקים לכל שלב, כמו דיוק השליפה, ביסוס המידע על המקור ובחירת הכלים הנכונה של הסוכן.

  • מודלים ותשתית
  • קוד פתוח
  • ממשק באנגלית

דירוג הקהילה

עוד לא דורג

תהיו הראשונים לדרג.

התחברות עם גוגל

דירוג אחד לכל אדם לכל כלי, ולכן צריך חשבון. אנחנו שומרים גיבוב של מזהה החשבון ואת השם הפרטי, ולא את הדוא״ל, לא את שם המשפחה ולא את התמונה.

לא נשלח אליכם דבר ולא נפרסם דבר בשמכם.

איך הדירוג עובד+

הדירוג פתוח רק למי שמחובר עם חשבון גוגל, דירוג אחד לכל אדם לכל כלי. זו הדרך שלנו לוודא שמדובר באדם אמיתי: היא אינה מוכיחה שהמדרג השתמש בכלי, וזה הבדל שכדאי לזכור כשקוראים ממוצע.

מי שכותב ביקורת מוצג בשמו הפרטי בלבד, כפי שהוא מופיע בחשבון גוגל. מעבר לזה לא נשמר דבר: לא שם משפחה, לא כתובת דוא״ל ולא תמונה: רק גיבוב חד־כיווני של מזהה החשבון, שמאפשר לכם לשנות את הדירוג שלכם ולא מאפשר לנו לדעת מי אתם.

ביקורת אינה יכולה להכיל קישורים, כתובות דוא״ל, מספרי טלפון או שמות משתמש. זה לא סינון תוכן, זה מה שמונע ממקום כזה להפוך ללוח מודעות.

תמחור
קוד פתוח
קטגוריה
מודלים ותשתית
שפת האתר
אנגלית
כתובת
trulens.org
נבדק
2026-09-08

הסקירה

כשמריצים את TruLens, הוא מתיישב על הקריאות של סוכן ה־AI שלכם ורושם כל צעד בנפרד, החל מתוכנית הפעולה, דרך שליפת המידע וכלה בקריאה לכלים חיצוניים. הוא מודד זמני ריצה בכל שלב, סופר טוקנים של קלט ופלט, ומחשב את העלות הכספית המדויקת בדולרים לפי המודל שהופעל. בנוסף לרישום הטכני, הוא מפעיל שופטים מבוססי מודלים שבודקים מדדים כמו רלוונטיות ההקשר, היצמדות לתוכנית ובחירת כלים נכונה, ומחזיר הסבר מילולי מנומק לכל ציון נמוך כדי שתדעו בדיוק היכן הסוכן סטה מהמסלול.

המעקב שקוף לחלוטין.

מה שמבדיל את הכלי מחבילות כמו WandB Weave או RAGAS הוא התבססות טבעית על OpenTelemetry יחד עם התמקדות בפירוק פעולות של סוכנים רב־שלביים. הוא לא מסתפק בבדיקת התוצאה הסופית מול השאלה המקורית, אלא מפרק את המסלול לצעדים נפרדים ובודק אם הכלי הנכון הופעל עם הפרמטרים הנכונים. במבחני השוואה שפורסמו במרץ 2026, הוא דורג ראשון במדדי רלוונטיות הקשר, ותפס 267 מתוך 281 שגיאות בניסויים על סוכנים מול מאגרי TRAIL ו־GAIA, מול 55 אחוזים בלבד שתפס שופט הבסיס. זה שווה את זה רק אם אתם מריצים סוכנים מורכבים בייצור וצריכים הוכחה מדויקת למה תשובה מסוימת נכשלה. לא הייתי משתמש בזה לפרויקטים פשוטים שרק שולחים פרומפט ומקבלים תשובה קצרה.

כמה זה עולה ולמה אין מחיר

קוד המקור מופץ תחת רישיון MIT דרך GitHub עם יותר מ־3,500 כוכבים ו־42 אלף הורדות חודשיות מחבילת הליבה. התקנת ספריית הפייתון trulens אינה עולה דבר, ואתם יכולים להריץ את הניטור והערכות המדדים על התשתית שלכם ללא תשלום לחברה. עם זאת, קיים באתר מסלול בתשלום, אך החברה אינה מפרסמת מחירון מסודר, מדרגות שימוש או תמחור לפי קריאות, כך שאין שום אפשרות לדעת מראש מה גובה העסקה לפני פנייה לנציג. רוב צוותי הפיתוח יתחילו ויישארו בחבילת הקוד הפתוח, שכוללת את השופטים המוכנים והחיבורים לקוד.

אין מחירון גלוי.

מה שבאמת מפריע כאן הוא העלות הנסתרת של הרצת השופטים בעצמכם, נתון שהאתר מעדיף להצניע ברקע. השופטים שמנתחים את הפלטים הם בעצמם מודלים שדורשים טוקנים, ולכן כל בדיקת איכות של הרצה מייצרת חשבון נוסף אצל ספק המודל שלכם. בריצת דוגמה אחת של סוכן תמיכה עם claude-opus-5, נרשמו 502 טוקנים בעלות ישירה של 0.01074 דולר לאותה פעולה בודדת. אם תריצו הערכות מלאות על אלפי אינטראקציות ביום, חשבון ה־API שלכם יתנפח במהירות בלי קשר לשאלה אם שילמתם ישירות ליוצרי הכלי.

עברית והתאמה למערכות מקומיות

כל ממשק הכלי, התיעוד ודפי ההסבר מוצגים באנגלית בלבד, ואין שום התייחסות רשמית לתמיכה ישירה בעברית באתר. עם זאת, מכיוון שהכלי מאפשר להגדיר רובריקות מותאמות, להוסיף דוגמאות אימון ולכוונן הוראות ספציפיות לשופטים, אתם יכולים לנסח בדיקות איכות משלכם שמותאמות לטקסט עברי. הדיוק של שופטי הבסיס בעברית אינו מגובה בנתונים או במבחני ביצועים בחומר הרשמי, ולכן תצטרכו לכייל אותם מחדש בעזרת דוגמאות מקומיות כדי לוודא שהם מבינים הקשר לשוני נכון ולא מורידים ניקוד על ניסוח תקני.

ההתאמה לשוק המקומי דורשת עבודה.

הכלי מתאים לצוותי הנדסת תוכנה שמפתחים מערכות RAG מרובות שלבים או סוכנים עצמאיים שנכשלים בייצור ודורשים איתור שגיאות מעמיק. הוא לא מתאים למנהלי מוצר שמחפשים ממשק גרפי מוכן ללא קוד, וגם לא למי שמפתח צ׳אטבוט בסיסי שלא מפעיל כלים חיצוניים ולא מבצע תוכניות מורכבות. אם אתם לא כותבים קוד בפייתון ולא מנטרים עשרות קריאות מודל בשרשרת, ההטמעה של חבילה כזו תעמיס מורכבות מיותרת על המערכת שלכם.

צעדי ניטור והערכה בכלי

  1. 01הקלטת זמני ריצה לכל שלב
  2. 02ספירת טוקנים וחישוב עלות דולרית
  3. 03בדיקת רלוונטיות שליפת המידע
  4. 04ניתוח בחירת כלים וקריאות פונקציה
  5. 05כוונון רובריקות מותאמות עם דוגמאות
  • רישיון ליבהMIT קוד פתוח
  • מחירון מסחרילא פורסם באתר
  • גרסה נוכחיתv2.14.0

מה TruLens for LLMs
עושה

מתקינים את החבילה בפייתון ומחברים אותה לאפליקציה באמצעות תקן OpenTelemetry. בכל פעם שהסוכן פועל, הוא שומר עץ שלם של הקריאות, מהתכנון והחיפוש בכלים ועד לטקסט הסופי שנשלח למשתמש, כולל פירוט הטוקנים והעלות בדולרים לכל קריאת מודל.

במקביל, מודלי שיפוט בוחנים מדדים מוגדרים מראש כמו רלוונטיות ההקשר וביסוס הטענות. אפשר לקחת את מדדי ברירת המחדל או להגדיר להם רובריקה מותאמת אישית עם דוגמאות ספציפיות לעסק שלכם, וכשציון מסוים נכשל, מקבלים הסבר מילולי מלא שמצביע ישירות על הכשל בריצה.

כמה זה
עולה

קוד המקור פתוח וזמין בחינם ברישיון MIT, אך האתר מציין קיומן של אפשרויות בתשלום בלי לחשוף מסלולים או מחירי מנוי.

קוד פתוח

המספרים נקראו מעמוד התמחור של TruLens for LLMs ב־2026-09-09. תמחור משתנה. לפני החלטה כדאי לפתוח את עמוד התמחור עצמו.

למי זה
מתאים

מתאים למפתחי פייתון וצוותי בינה מלאכותית שבונים סוכנים או מנגנוני מענה מבוססי מסמכים, וצריכים לדעת למה התשובות נופלות בייצור וכמה כסף מתבזבז על כל קריאה.

לא מתאים למי שמחפש פתרון ללא קוד, ולא למי שרק מפעיל קריאה פשוטה למודל בלי צעדי ביניים, שימוש בכלים או שליפת מידע.

מה לבדוק
לפני שמתחייבים

בדקו היטב את תמיכת השופטים המובנים בעברית. המדדים של הכלי נשענים על מודלים שבוחנים ביסוס ורלוונטיות, וטקסטים בעברית עלולים להניב ציונים פחות מדויקים בהשוואה לאנגלית ללא התאמה ייעודית.

בנוסף, הרצת שופטי בינה מלאכותית על כל בקשה מוסיפה עלויות קריאה משלה לחשבון ספק המודלים שלכם.

מה אומרים
המשתמשים

עוד אף אחד לא כתב על TruLens for LLMs כאן. אם השתמשתם בTruLens for LLMs, השורה הראשונה היא שלכם.

להשאיר חוות דעת אנחנו לא מוחקים ביקורת שלילית, ולא מסמנים אף כלי כמומלץ בתשלום.

מה TruLens for LLMs
אומר על עצמו

TruLens instruments your AI agent with OpenTelemetry, scores every step with benchmarked LLM judges, and tells you which version to ship.

מהאתר של TruLens for LLMs, נקרא ב־2026-09-08. הטקסט הוא שלהם.

אנחנו לא מתרגמים תיאורי שיווק ומגישים אותם ככתיבה שלנו. שיטת העבודה.

שאלות
נפוצות

איך הכלי משתלב בפרויקטים קיימים?

הוא מתבסס על תקן OpenTelemetry וזמין כספריית פייתון עם רישיון MIT. החיבור לקוד מתבצע ברמת הפונקציות שמנהלות את הצעדים של הסוכן, ומשם הנתונים נשמרים למעקב.

האם אפשר להגדיר מבחנים ספציפיים לתחום שלי?

כן. ניתן להזין קריטריונים מילוליים, הנחיות נוספות ודוגמאות תשובות עם ציונים, כדי להתאים את השופט לכללי המענה הדרושים לכם.

מה TruLens for LLMs עושה?

הקוד הפתוח הזה מיועד לניטור ובדיקה של סוכני בינה מלאכותית ומערכות שליפת מידע. במקום לנחש למה הסוכן החזיר תשובה שגויה, הוא מפרק את הריצה למקטעים ומודד זמנים, טוקנים ועלויות מדויקות בכל שלב. ההבדל העיקרי מול פתרונות ניטור אחרים מגיע ממנגנוני השיפוט המובנים שלו, שמגיעים עם ציונים מנומקים לכל שלב, כמו דיוק השליפה, ביסוס המידע על המקור ובחירת הכלים הנכונה של הסוכן.

האם TruLens for LLMs חינמי?

לפי מה שהאתר של TruLens for LLMs מפרסם, קוד פתוח. תנאים משתנים. כדאי לאמת מול עמוד התמחור שלו.

האם TruLens for LLMs תומך בעברית?

האתר של TruLens for LLMs מוגש באנגלית. זה לא אומר שהכלי לא יעבוד עם טקסט בעברית, אבל זה כן אומר שהוא לא נבנה סביבה.

יש חלופות ל־TruLens for LLMs?

כן. באתר יש 101 כלים בקטגוריית מודלים ותשתית, וחלקם מוצגים בתחתית העמוד הזה. ההשוואה שכדאי לעשות היא בין תמחור, שפת הממשק והתאמה למה שאתם צריכים לעשות, לא בין רשימות תכונות.

כלים דומיםבמודלים ותשתית

כל 101 הכלים
  • T קוד פתוח

    Truss

    אריזה והגדרה של מודלי בינה מלאכותית בקונטיינרים לפריסה בייצור.

    מודלים ותשתית truss.baseten.co
  • הלוגו של UAF קוד פתוח

    UAF

    דומיין אינטרנט שמוצע כרגע למכירה ולא מפעיל שום שירות פעיל.

    מודלים ותשתית uaf.ai
  • הלוגו של Wallaroo.AI בתשלום

    Wallaroo.AI

    פריסה, הרצה וניטור של מודלי בינה מלאכותית על ענן, שרתים מקומיים והתקני קצה.

    מודלים ותשתית wallaroo.ai
  • הלוגו של Weights & Biases לא צוין

    Weights & Biases

    ניטור, בדיקה והערכת ביצועים של סוכני בינה מלאכותית בסביבת ייצור

    מודלים ותשתית wandb.ai
  • W קוד פתוח

    What’s in the RedPajama-Data-1T LLM training set

    מאגר נתונים פתוח של 1.2 טריליון טוקנים לאימון מודלי שפה בסגנון LLaMA.

    מודלים ותשתית simonwillison.net
  • הלוגו של xAI בתשלום

    xAI

    גישה למודל Grok 4.6 לפיתוח תוכנה, קול, תמונה וטקסט דרך ממשק תכנות אחיד.

    מודלים ותשתית x.ai