输出符合语料库规范的文本和时间戳文件
SpeechAnnotator也就是贵鹤语音标注工作台,支持导入常见音频格式,包含WAV、MP3等田野调查最常用的录音文件,可以批量预览音频时长和标注状态,直观查看哪些音频待标注、标注完成或者等待质检,还可以批量导出标注结果,输出符合语料库规范的文本和时间戳文件,方便导入其他语料分析工具。
1)长音频初次加载需要一定时间绘制波形,等待波形渲染完成,不要中途关闭软件。

2)如果音频采样率、位深不兼容,会出现波形无法渲染的情况,可以用音频工具把音频转换为 16bit,16kHz 或 44100Hz 标准 WAV 格式。

3)内存不足也会导致波形渲染异常,关闭电脑后台大型软件,释放内存后重新打开工程。
① 导出时选择 UTF-8 编码,不要使用 ANSI 编码。
② 导出的文本使用记事本或者 VS Code 打开,不要用老旧文本编辑器。

③ 如果标注包含方言国际音标、特殊记音符号,需要电脑系统安装对应字体,否则会出现方框乱码,导出文件本身内容没有损坏,只是缺少字体渲染。

集成音频波形与频谱显示,导入音频后可以直观看到声波起伏,精准定位语音片段、停顿、噪音区间。
标注员可以在波形上直接打点切分,手动切割音频,划分句子、词汇和音素层级。
内置音频播放控制,包含逐句循环、片段循环、慢速回放以及前后帧微调,不需要反复拖动进度条。
慢速播放功能对于方言、小语种、语速较快的口语录音非常实用,解决普通播放器难以精细听辨的痛点。
软件分类:信息管理
运行环境:win7及以上
官网地址:https://www.guihesoft.com/front/downdetail/29
软件语言:简体中文
授权:免费软件
软件类型:应用软件
备案号:黔ICP备20004201号-7