GPT
S

small-talk

רץ בדפדפן

build-small-hackathonרישיון לא דווח2026-06-10

  • gradio
  • reachy_mini
  • livekit
  • webrtc
  • three.js

הכלי מפיק פודקאסט חי בין רובוטים וירטואליים לפי נושא שתבחרו. הוא מתאים למי שרוצה לראות מודלים קטנים מנהלים שיחה קולית מלאה בתלת ממד.

  • הורדות בחודש
  • 140לייקים

מה זה

אתם מזינים נושא לשיחה ובוחרים בין שניים לחמישה רובוטים מסוג Reachy Mini כמנחים. אפשר גם לקבוע להם שמות, קולות ואביזרים, או להיכנס לתחנת רדיו מובנית בשם Reachy FM שמנגנת שירים עם מילות קריוקי ומנחה וירטואלי שמגיב לקצב.

בתגובה מקבלים שידור חי שנראה כמו שיחת ועידה מרובת משתתפים. הדמויות התלת ממדיות מונפשות ומזיזות את הראש והאנטנות בסנכרון מלא לדיבור, בליווי כתוביות רצות בזמן אמת.

מאחורי הקלעים רץ המודל NVIDIA Nemotron 4B דרך llama.cpp, שמייצר בקריאה בודדת ומובנית את כל התסריט וחלוקת התפקידים. את האודיו יוצר מודל Qwen3-TTS, והסאונד מועבר ישירות לדפדפן ברשת WebRTC דרך שרת LiveKit כדי למנוע שתיקות בין הדוברים.

מתאים ל

  • המחשת שיחה בין מודלים

    צפייה בדיון אוטונומי קולי בין כמה דמויות AI בתלת ממד לפי נושא נבחר.

  • הפעלת רובוט פיזי

    חיבור רובוט Reachy Mini אמיתי דרך קובץ Go כדי שישתתף בפודקאסט וידבר בקולו.

  • האזנה לתחנת רדיו AI

    השמעת שירים שנוצרו במערכת יחד עם מילות קריוקי מסונכרנות ורובוט תקליטן.

איפה זה נופל

זהו פרויקט הדגמה שנבנה להאקתון סביב מודלים זעירים. אם הנושא שלכם דורש עובדות מורכבות או דיון מקצועי מעמיק, מודל של 4B יגיע מהר מאוד למגבלות שלו וייטה להמציא דברים. כמו כן, הממשק והדיבור מבוססים על קולות מותאמים ולא מיועדים לעברית.

שאלות
נפוצות

האם השימוש עולה כסף?

הכלי פתוח בדפדפן ללא תשלום וללא צורך בהזנת פרטי אשראי. כל החישובים מנוהלים בצד השרת של המפתחים.

מה קורה עם התוכן שמזינים?

הנושא שתקלידו מועבר למודל השפה לצורך כתיבת התסריט ולא נשמר במאגר פרטי. אין כאן העלאת קבצים אישיים, אבל כל מה שנכתב גלוי למערכת.

האם אפשר להריץ את זה מקומית?

הקוד פתוח בגיטהאב וניתן להרצה עצמית. עם זאת, תצטרכו להגדיר שרתי Modal משלכם עבור Nemotron ו־Qwen3-TTS, ולהרים שרת LiveKit לתקשורת WebRTC.

במה זה שונה משיחה עם צ'אטבוט רגיל?

כאן מודל השפה לא עונה לכם אלא מייצר תסריט שלם בין כמה מנחים. במקום טקסט יבש, המערכת ממירה את הדו שיח לקולות נפרדים ומסנכרנת מודלים תלת ממדיים בזמן אמת.

איך משתמשים

נכנסים לעמוד, בוחרים נושא ומשגרים את השידור. אין צורך בהרשמה או התחברות כדי לצפות. העיבוד הכבד של הטקסט והקול לא מעמיס על המעבד המקומי של העמוד כי הוא נשלח לשרתי Modal חיצוניים, והשורה הבאה של התסריט מרונדרת ברקע בזמן שהנוכחית מושמעת. התהליך מתחיל כמעט מיד ללא תור ידוע מראש.

הרישיון

היוצרים לא הגדירו רישיון שימוש מפורש בקוד הפרויקט. כדאי להתייחס אליו כקוד להדגמה ומחקר בלבד, ולא להעתיק או להשתמש בחומרים שנוצרים בו למטרות מסחריות בלי אישור מהמפתחים.

הרישיון המלא ב־Hugging Face ↗