选择录音
添加浏览器支持的音频或视频文件,也可以直接使用麦克风录音。
将不同声音标记为“说话人 1”“说话人 2”等,同时让录音保留在您的设备上。
您可以从 Whisper 模型支持的 99 种语言中选择,也可以让工具自动检测录音语言。其中包括中文、英语、西班牙语、阿拉伯语、印地语、日语、俄语、越南语等。
本工具使用开放的 Whisper 语音识别模型,在本地转录音频和视频。LocalScribe 与 OpenAI 没有隶属关系。 进一步了解 Whisper 转录 →
您的文件会保持私密,并在本设备上处理。
默认选择快速转录。
添加浏览器支持的音频或视频文件,也可以直接使用麦克风录音。
选择录音语言或自动检测,然后在屏幕上查看处理进度。
校对文字,并保存为 TXT、SRT 或 WebVTT 字幕文件。
可选的说话人分离会分析声音特征,并将匿名标签对应到带时间戳的转录片段。它不会识别姓名或个人身份。
检查会议记录和决定时,用匿名标签区分录制通话和讨论中的参与者。
将问题与回答分开,让访谈转录文本更容易阅读和整理。
在节目、圆桌讨论和录制对话中标记说话人的切换。
检查结果后,下载包含说话人前缀的文字和带时间戳字幕。
您选择的录音和生成的转录文本都保留在您的设备上。工具在本地处理内容,不会把这些文件发送到我们的服务器。
说话人分离用于推测谁在什么时候发言。工具使用“说话人 1”“说话人 2”等匿名标签,不会按姓名识别人物。
是的。启用后,转录和声音分析都在您的设备上进行。首次使用时,浏览器会下载并缓存额外模型。
需要。多人同时说话、背景噪声、简短回答和相似声音都可能导致标签错误,请在发布前校对。
这项可选功能会在转录后额外进行声音分段和比较。只有启用说话人标签时,才会使用额外模型和处理步骤。