در این حالت، خواننده با خواندن متن، به دنبال کلمات و عبارات است و در صورتی که کلمات را به صورت متنی بخوانید، متن به صورت متنی و در صورتی که کلمات را به صورت متنی بخوانید، متن به صورت متنی خواهد بود.
ثبت نام نشده
بدون نشان آبی
صادرات TXT · SRT · VTT
حذف خودکار پروندهها در ۲۴ ساعت
پروندۀ شما را به اینجا بکشید و بگذارید
یا مرور پروندههای شما
رایگان: {0} پرونده در روز · تا {1} دقیقه و هر کدام {2} مگابایت
0:00
پیشنویس زنده
کلمات همانطور که صحبت میکنید ظاهر میشوند، به صورت زنده توسط هوش مصنوعی خودمان رونوشت میشوند - وقتی کار را تمام کردید برای نسخهٔ تمیز و قابل ویرایش، رونوشت را فشار دهید.
دسترسی به میکروفون مسدود شد — در تنظیمات سایت مرورگر خود اجازه دهید یا در عوض یک پرونده را بارگذاری کنید.
در واقع زنده: سخنرانی شما به هوش مصنوعی ما در حالی که شما صحبت می کنید
در حالی که شما ضبط میکنید، صفحه جریان میکروفن را به بخشهای کوتاه تقسیم میکند — هر کدام چند ثانیه طول میکشد، به صورت انطباقی قطع میشود تا در لحظه بازگشت قبلی، بعدی ارسال شود — و هر کدام را مستقیماً به سرورهای GPU ما میفرستد، جایی که همان مدل کلاس Whisper که تمام سایت را قدرت میدهد، بلافاصله آن را رونویسی میکند. متن در ثانیه بعد از صدای شما در جریان زنده قرار میگیرد و تا زمانی که شما صحبت میکنید جریان دارد. هیچ سرویس گفتار مرورگر، هیچ API دیکتاتور سومی وجود ندارد — متن زنده خروجی واقعی Whisper از سختافزار خود ماست.
از آنجایی که تنها نیاز به ضبط میکروفون دارد، حالت زنده در هر مرورگر مدرنی کار میکند - کروم، ادج، سافاری و فایرفاکس، دسکتاپ و تلفن. هر بخش صوتی از سرورهای ما حذف میشود، زمانی که متن آن برمیگردد.
.
رونویسی بخش به بخش یک محدودیت داخلی دارد: مدل در یک زمان چند ثانیه را میبیند، بنابراین یک کلمه که در دو بخش قرار دارد میتواند بریده شود، و نشانه گذاری در مرزهای بخش حدس است. به همین دلیل جریان با یک گام دیگر پایان مییابد: ضبط کامل در مرورگر شما در حالی که صحبت میکنید نگه داشته میشود، و فشار دادن رونویسی آن را به عنوان یک تک تک از طریق مدل اجرا میکند - متن کامل، نشانه گذاری مناسب، مهرهای زمانی، ویرایشگر و صادرات TXT / SRT / VTT.
از تغذیه زنده برای تأیید اینکه با زمان همگام است و برای گرفتن متن در لحظه صحبت کردن استفاده کنید (دکمۀ رونوشت در تغذیه وجود دارد) ، از گذر آخر برای هر چیزی که نگه میدارید استفاده کنید. برای صدایی که از قبل به عنوان پرونده دارید ، حالت بارگذاری در هر صفحه ابزار مسیر کوتاهتری است.
پرسشهای متداول
اين واقعاً زنده بود يا ضبط شده و بعدا فرستاده شده؟
در واقع زنده: ضبط و رونویسی همپوشانی دارند. صفحه هر تکه چند ثانیهای از صدا را به GPUهای ما ارسال میکند در حالی که شما هنوز در حال صحبت کردن هستید، بنابراین متن در طول ضبط انباشته میشود، نه بعد از آن. انتظار داشته باشید که تغذیه چند ثانیه پس از صدای شما اجرا شود - زمان لازم برای تکه برای پایان، بارگذاری و رونویسی.
چرا متن زنده چند ثانيه پشت سر من قرار داره؟
سه تاخیر کوچک روی هم انباشته میشوند: یک قطعه باید ضبط را تمام کند (سه ثانیه یا بیشتر)، به سرور سفر کند، و از طریق مدل عبور کند. این معمولاً تغذیه را حدود ۴ تا ۸ ثانیه پشت صدای شما قرار میدهد - و اگر GPU ما برای مدت کوتاهی مشغول باشد، صفحه با ارسال قطعههای کمی طولانیتر به جای عقب افتادن، سازگاری میکند. گفتار طبیعی با توقفها احساس نرمی میکند.
چه مرورگری حالت زنده را اجرا میکند؟
همه مدرنها — کروم، Edge، Safari و Firefox، روی دسکتاپ و تلفنها. این بر ضبط میکروفن استاندارد به جای یک سرویس مرورگر صحبت تکیه میکند، بنابراین در Firefox به همان اندازه در کروم کار میکند.
صداي من وقتي که رونوشت زنده اجرا ميشه کجا ميره؟
فقط برای سرورهای ما، و صادقانه توضیح داده شده: حالت زنده صدای شما را در بخشهای کوتاهی به ما میرساند، همانطور که صحبت میکنید - این چیزی است که آن را زنده میکند - و هر بخش بلافاصله پس از بازگشت متن آن حذف میشود. هیچ چیز به گوگل، اپل یا هر سرویس گفتار سومی نمیرود. ضبط کامل در مرورگر شما باقی میماند تا زمانی که شما رونوشت را فشار دهید، و رونوشتهای ناشناس به صورت خودکار در ۲۴ ساعت حذف میشوند.
ميشه ازش براي دنبال کردن جلسه يا سخنراني تو اتاق استفاده کنم؟
به عنوان یک کمک شخصی، بله — دستگاه را نزدیک بلندگو قرار دهید و صدای پخش شده به خوبی و واضح، حدود ده ثانیه عقب تر از آن است. محدودیت ها را بدانید: یک میکروفون، بنابراین صداهای دور و گفتارهای متقابل آن را خراب می کند، و این یک سرویس زیرنویسی گواهی شده برای رعایت دسترسی نیست. در پایان رونویسی را فشار دهید و گذر کامل متن معمولاً آنچه را که پخش زنده با آن مشکل داشت را بازیابی می کند.
کدوم زبان ها زنده کار ميکنن و بايد يکي رو انتخاب کنم؟
همان ۹۰ زبان و بیشتر که در هر رونوشت در این سایت وجود دارد — این یک مدل است. یک نکته خاص برای حالت زنده: زبان خود را در گزینشگر انتخاب کنید به جای اینکه تشخیص خودکار را روشن بگذارید. تشخیص به صورت بخش به بخش انجام میشود و هفت ثانیه شواهد زیادی نیست، بنابراین پیچاندن زبان از جابجایی در جملههای کوتاه یا با لهجه جلوگیری میکند.