למעשה לחיות: צינורות הדיבור שלך לAI שלנו בזמן שאתה מדבר
בזמן שאתה מקליט, הדף חותך את זרם המיקרופון לחלקים קצרים □ כמה שניות כל אחת, חותך באופן מסתגל כך שברגע שהקודם ינחת חזרה ▪ וימשיך לזרום עד ש-Whisper יחידות, אין שירות דפדפן, אין קביעת צד שלישי, אין חיבור חי של 88 אלף שניות מאחורי הקול שלך.
מכיוון שהוא זקוק רק להקלטה של מיקרופון, מצב חי עובד בכל דפדפן מודרני □ Chrome, Edge, Safari, ו־ Firefox, שולחן עבודה וטלפון. כל קטע אודיו נמחק מהשרתים שלנו ברגע שהטקסט חוזר.
השידור החי לעומת התעתיק הסופי
להעתק של שני קטעים אפשר להוציא מקוטע, ופיסוק על פני גבולות המקטע הוא ניחוש. לכן הזרם מסתיים בצעד אחד נוסף: ההקלטה המלאה נשמרת בדפדפן בזמן שאתה מדבר, ולחיצה על פיסוק דרך גבולות המקטע היא ניחוש. לכן התהליך מסתיים עם עוד צעד אחד:
השתמש בשידור החי כדי לאשר שהוא ממשיך ותופס טקסט ברגע שהוא מדבר (יש כפתור העתקה בהזנה); השתמש במעבר הסופי עבור כל דבר שאתה שומר. עבור שמע שכבר יש לך בתור קובץ, מצב העלאה בכל עמוד כל כלי הוא הנתיב הקצר יותר.
שאלות לעתים קרובות
האם זה באמת לחיות, או נרשם ונשלח לאחר מכן?
למעשה בשידור חי: הקלטה והעתקה חופפים. כל פיסת אודיו של דף לשנייה בודדת אל GPUs שלנו בזמן שאתה עדיין מדבר הבא, כך טקסט מצטבר במהלך ההקלטה, לא אחריו. צפה שהשידור יריץ חופן שניות מאחורי הקול שלך בזמן שלוקח פרוסה לסיים, להעלות ולתעתוק.
למה ההודעה החיה כמה שניות מאחורי?
שלושה עיכובים קטנים נערמים למעלה: פרוסה צריכה לסיים את ההקלטה (שלוש שניות בערך), לנסוע לשרת, ולעבור דרך המודל. בדרך כלל זה שם את ההזנה כ-4-8 שניות מאחורי הקול שלך ואם GPUs שלנו עסוקים לזמן קצר, הדף מסתגל על ידי שליחת פרוסות מעט יותר ארוכות במקום ליפול מאחור. דיבור טבעי עם נשימות מרגיש חלק.
באיזה דפדפן עובד מצב חי?
כל המודרניים □ כרום, אדג ', ספארי ופיירפוקס, על שולחן העבודה וטלפונים. הוא מסתמך על הקלטה סטנדרטית של מיקרופון ולא על שירות דיבור בדפדפן, כך הוא עובד בפיירפוקס בדיוק כמו גם בכרום.
לאן הקול שלי הולך בזמן שתהליך התעתיק חי פועל?
לשרתים שלנו בלבד, ובכנות מתואר: מצב חי מעביר אלינו את השמע בקטעים קצרים בזמן שאתה מדבר □ זה מה שעושה אותו חי ▪ וכל קטע נמחק מיד לאחר שהטקסט שלו חוזר. שום דבר לא הולך לגוגל, אפל, או כל שירות דיבור שלישי. ההקלטה המלאה נשארת בדפדפן שלך עד שאתה לוחץ על Tranchrit, ותעתיק אנונימי תוך 24 שעות.
אני יכול להשתמש בו כדי לעקוב אחר פגישה או הרצאה בחדר?
כסיוע אישי, כן □ לשים את המכשיר ליד הדובר ואת מסלולי ההזנה דיבור ברור היטב, כעשר שניות מאחור. דע את הגבולות: מיקרופון אחד, קולות מרוחקים כל כך וknowlude להכפיש אותו, וזה לא שירות כתוביות מוסמך לציות נגישות. לחץ על רשומת בסוף ואת המעבר המלא של הטקסט בדרך כלל לשחזר מה ההזנה החיה distided.
איזו שפה עובדת, ואני צריך לבחור אחת?
אותו 90+ שפות כמו כל תמליל באתר זה ▪ זה אותו מודל. טיפ אחד ספציפי למצב חי: בחר את השפה שלך בבוחר במקום להשאיר אוטומטית על גבי. זיהוי פועל לכל קטע, ושבע שניות אינן עדות רבה, כך שהשפה מונעת מהזנת ההזנה מלהיחלש על ביטויים קצרים או מופנים.