Automatic Speech Recognition for Multilingual Oral History Research
本文提出社区主导的文化遗产语言保护与复兴项目正采用语音技术。在新西兰粤语复兴中,口述历史作为关键的语言维护策略,其转录工作常因耗时耗力而受阻。自动语音识别(ASR)工具包如 Whisper 的开发加速了这一过程,但针对语码转换语境的有效性研究有限。基于字错率(WER),表现最佳的 Whisper 模型配置 WER 为 12.10,代价是未能准确转录非英语部分;尽管如此,该工具仍有用,仅需占手动转录预估时间的 1% 即可提供初稿转录。