Bản dịch trực tiếp

Nhấn ghi âm và các từ của bạn sẽ được truyền tải trực tiếp đến AI của chúng tôi - văn bản xuất hiện vài giây sau giọng nói của bạn, và một bản ghi chép được làm sạch sẽ xuất hiện khi bạn dừng lại.

Không đăng ký Không hình mờ Xuất TXT · SRT · VTT Tập tin tự động xoá sau 24h
Kéo và thả tập tin của bạn vào đây
hoặc duyệt tập tin của bạn
Miễn phí: {0} tập tin mỗi ngày · lên đến {1} phút và {2} MB mỗi tập tin
0:00
Dự thảo trực tiếp
Các từ xuất hiện khi bạn nói, được phiên âm trực tiếp bởi AI của chúng tôi — nhấn Transcribe khi bạn hoàn thành cho phiên bản được làm sạch, có thể chỉnh sửa.
Truy cập microphone đã bị chặn — cho phép trong cài đặt trang web của trình duyệt, hoặc tải lên một tập tin thay thế.

Tập tin lớn hơn hay tải lên nhiều hơn? Tài khoản miễn phí: 5 tập tin/ngày, tập tin 1 giờ · Pro: tập tin 10 giờ + nhãn người nói

0%
Đang tải lên...
Giữ tab này mở — bạn sẽ được chuyển đến bản ghi chép của bạn.
Talks & speechesReal-time notesIn-room speechAccessibility

Thực sự là sống: lời nói của bạn được truyền đến AI của chúng tôi khi bạn nói

Trong khi bạn ghi âm, trang web cắt dòng microphone thành các đoạn ngắn — mỗi đoạn vài giây, cắt theo cách thích ứng để dòng tiếp theo được gửi ngay khi dòng trước đó trở lại — và dẫn mỗi đoạn thẳng đến máy chủ GPU của chúng tôi, nơi mà cùng một mô hình lớp Whisper mà cung cấp năng lượng cho toàn bộ trang web chuyển đổi nó ngay lập tức. Văn bản xuất hiện trong nguồn trực tiếp sau giọng nói của bạn và tiếp tục chảy cho đến khi bạn nói. Không có dịch vụ nói chuyện trình duyệt, không có API ghi âm của bên thứ ba — văn bản trực tiếp là Whisper thực sự xuất ra từ phần cứng của chúng tôi.

Vì nó chỉ cần ghi âm micrô, chế độ trực tiếp hoạt động trên mọi trình duyệt hiện đại — Chrome, Edge, Safari, và Firefox, máy tính và điện thoại. Mỗi đoạn âm thanh được xóa khỏi máy chủ của chúng tôi ngay khi văn bản của nó trở lại.

Truyền hình trực tiếp và bản ghi chép cuối cùng

Phiên âm từng đoạn từng đoạn có một giới hạn nội tại: mô hình nhìn thấy vài giây một lần, vì vậy một từ nối hai đoạn có thể được cắt, và dấu chấm giữa các ranh giới của đoạn là dự đoán. Đó là lý do tại sao dòng chảy kết thúc với một bước nữa: toàn bộ ghi âm được giữ trong trình duyệt của bạn khi bạn nói, và nhấn Transcribe chạy nó qua mô hình như một lần thu duy nhất - hoàn toàn ngữ cảnh, dấu chấm đúng, dấu thời gian, biên tập và xuất khẩu TXT/SRT/VTT.

Dùng nguồn trực tiếp để xác nhận nó đang tiếp tục và để lấy văn bản ngay khi nó được nói (có một nút sao chép trên nguồn); dùng lượt cuối cùng cho bất cứ thứ gì bạn muốn giữ. Đối với âm thanh bạn đã có như một tập tin, chế độ tải lên trên bất kỳ trang công cụ nào là đường dẫn ngắn hơn.

Câu hỏi thường gặp

Đây là cuộc nói chuyện trực tiếp hay là ghi âm và gửi sau đó?
Thực tế là trực tiếp: ghi âm và phiên dịch trùng lặp. Trang gửi mỗi đoạn âm thanh vài giây đến GPU của chúng tôi trong khi bạn vẫn đang nói đoạn tiếp theo, vì vậy văn bản tích lũy trong quá trình ghi âm, không phải sau đó. Chờ nguồn chạy một vài giây sau giọng nói của bạn — thời gian cần để một đoạn âm thanh hoàn thành, tải lên và phiên dịch.
Sao tin tức lại bị chậm lại vài giây so với tôi?
Ba sự chậm trễ nhỏ xếp chồng lên nhau: một đoạn phải kết thúc ghi âm (khoảng ba giây), đi đến máy chủ, và đi qua mô hình. Thường thì nó đặt nguồn khoảng 4- 8 giây sau giọng nói của bạn — và nếu GPU của chúng tôi bận một lúc, trang sẽ thích nghi bằng cách gửi những đoạn dài hơn một chút thay vì bị chậm lại. Lời nói tự nhiên với các dừng cảm thấy mượt mà.
Chế độ trực tiếp hoạt động trên trình duyệt nào?
Tất cả các hiện đại - Chrome, Edge, Safari, và Firefox, trên máy tính và điện thoại. Nó dựa trên ghi âm microphone tiêu chuẩn hơn là một dịch vụ nói chuyện trình duyệt, vì vậy nó hoạt động trong Firefox cũng như trong Chrome.
Giọng nói của tôi đi đâu khi bản dịch trực tiếp đang chạy?
Chỉ dành cho máy chủ của chúng tôi, và mô tả chân thành: chế độ trực tiếp truyền âm thanh của bạn cho chúng tôi theo các đoạn ngắn khi bạn nói — đó là điều làm nó trực tiếp — và mỗi đoạn sẽ bị xóa ngay sau khi văn bản của nó được trả lại. Không có gì được gửi đến Google, Apple, hoặc bất kỳ dịch vụ nói chuyện thứ ba nào. Tất cả các bản ghi lại sẽ ở trong trình duyệt của bạn cho đến khi bạn nhấn vào Transcribe, và các bản ghi nặc danh sẽ tự động xóa trong vòng 24 giờ.
Tôi có thể dùng nó để theo dõi một cuộc họp hay bài giảng trong phòng không?
Là một trợ lý cá nhân, có — đặt thiết bị gần loa và nguồn phát lại lời nói rõ ràng, khoảng mười giây sau. Hãy biết giới hạn: một microphone, vì vậy giọng nói xa và tiếng nói xuyên qua làm giảm nó, và nó không phải là dịch vụ phụ đề được chứng nhận để phù hợp với khả năng truy cập. Nhấn Transcribe ở cuối và thông qua hoàn toàn ngữ cảnh thường phục hồi những gì nguồn phát trực tiếp đã lộn xộn.
Ngôn ngữ nào hoạt động trực tiếp, và tôi nên chọn một?
Cũng như 90+ ngôn ngữ như mọi bản dịch trên trang này — nó là cùng một mô hình. Một lời khuyên đặc biệt cho chế độ trực tiếp: chọn ngôn ngữ của bạn trong bộ chọn thay vì để tự động nhận biết bật. Việc nhận biết chạy theo từng phân đoạn, và bảy giây không phải là nhiều bằng chứng, vì vậy ghim ngôn ngữ giữ nguồn không bị lệch về các cụm từ ngắn hoặc có dấu phụ.