现场连接

新闻记录和你的文字直接流到我们的AI上——文字出现在你声音后面几秒钟,停手时,一个光滑的文字记录就落下了。

无需注册 无水印 TXT · SRT · VTT 导出 24小时内自动删除文件
将文件拖放到此处
浏览您的文件
免费:每天 {0} 个文件 · 每个最长 {1} 分钟、最大 {2} MB
0:00
现场草稿
文字出现时, 由我们自己的AI 实时转录,
麦克风访问被屏蔽了, 允许在浏览器的网址设置中使用, 或者上传文件 。

需要更大的文件或更多上传次数? 免费账户:每天 5 个文件,单个文件最长 1 小时 · Pro:最长 10 小时的文件 + 说话人标签

0%
正在上传...
请保持此标签页打开——完成后将自动跳转到您的转录文本。
Talks & speechesReal-time notesIn-room speechAccessibility

实际直播:你说话时 向我们自己AI的讲道管道

当你记录时,页面将麦克风流切成短段——每段几秒钟,按情理剪切,在上一个返回时,下一艘船将接下去——然后将每一条管道直通我们的GPU服务器,在那里,整个网站的88,000级模型即能立即进行转录。文本在语音后以实时信号秒为位置,一直流到您继续说话的时段。没有浏览器语音服务,没有第三方的听写API—— 现场文本是我们自己硬件的Whisper输出。

因为它只需要麦克风录音,每个现代浏览器都使用现场模式,这些浏览器包括铬、边缘、Safari、Firefox、桌面和电话。 每一个音频段在文本一回来,就从我们的服务器上删除。

现场直播对最后的笔录

区段间段抄录有一个内设限制:模型一次看到几秒钟,所以一个单词可以将两个区段相加, 横跨段界的标点是猜测。 这就是为什么流程以一个步骤结束: 完整记录保存在浏览器中, 并且按链条将它作为单一方式通过模型运行—— 完整背景、 适当的标点、 时间戳、 编辑、 TXT/SRT/ VTT 导出 。

使用实时种子确认它跟在了上, 并抓住文本在它说话的那一刻( 种子上有一个复制按钮); 使用最后通行证来保存任何您要保存的。 对于您已经拥有的音频, 任何工具页上的上传模式都是较短的路径 。

常见问题

这是现场直播 还是录制后发送?
实际直播: 录音和抄录重叠。 页面将每秒几秒的音频 发到我们的 GPUs, 当你还在说下一个时, 所以文字会累积在录制过程中, 而不是在录制之后。 期待反馈在声音后面几秒钟运行—— 完成、 上传和抄录需要几秒时间 。
为什么我后面几秒钟才有直播短信?
三个小的延迟堆叠:一个切片必须被记录(三秒钟左右 ), 前往服务器, 并通过模型。 这通常会把种子放入你的声音后面大约4-8秒, 如果我们的GPU短暂忙碌, 页面会通过发送略长的切片而不是落后而适应。 自然的暂停讲话会感到顺畅。
哪些浏览器是活模式的工作?
所有现代的——铬、边缘、Safari和Firefox,都放在桌面和电话上,它依靠标准的麦克风录音而不是浏览器语音服务,因此它不仅在铬,而且在Firefox也使用。
现场抄录运行时我的声音会怎么听?
仅对服务器,并诚实地描述:即时即刻的直播模式将您的音频以短片段传送给我们, 也就是它能激活的。 文本一回来,每个部分就会立即删除。 谷歌、苹果或任何第三方演讲服务都不用。 完整记录一直保存在浏览器中, 直到您按下Trancamp, 并在24小时内自动删除匿名记录。
我能用它来跟踪 房间里的见面或演讲吗?
个人援助,是的,把装置贴近扬声器和传送音轨,清晰的言词,大约落后了10秒。知道限制:一个麦克风,如此遥远的声音和交叉对话会降低它,它不是符合无障碍条件的认证字幕服务。 结尾的报纸记录和全文传送通常能恢复活传音的功能。
哪种语言能活,我应该选哪一种语言?
与这个网站的每条抄录文本一样,90+语言也是同样的模式。一个与活模式特别相似的提示:选择器中选择您的语言,而不是离开自动探测。每个段段的探测运行,7秒是没有多少证据的,因此,将语言钉住使反馈无法用短语或口音发出波浪。