把录音转成文字稿,支持中文、英文、粤语、日语、韩语。全部在你的浏览器里完成,录音不会上传。
识别模型要在你的浏览器里运行,所以首次使用需要下载 228 MB 模型(连引擎共约 241 MB),下完会被浏览器缓存,之后打开就不用再下。 只有你点「开始转写」才会下载——不点不会耗流量。
只要视频里的声音,先用视频提取音频也可以, 不过这页直接丢视频进来同样可以; 想先截一段再转,用音频剪切。
AuraHub