智迹闻AuraTracer
EN

EVENT DOSSIER

多语言口述历史研究的自动语音识别技术

2026-09-07 12:00 大模型 🔥 40.2 事件热度
1家信源
1天持续发酵
40.2事件热度
2个提及
摘要由 AI 生成

2026 年 9 月 7 日,arXiv cs.CL 平台发布了一项针对多语种口述历史研究的自动语音识别(ASR)系统。该系统旨在解决口述历史研究中语言多样性带来的挑战,通过技术手段实现对多种语言口语内容的准确识别与处理,为相关领域的学术研究提供了新的工具支持。

相关事件RELATED EVENTS
关键实体KEY ENTITIES
WhisperarXiv

报道态势 · 每日报道量LANGUAGE SPLIT

实体关系
Whisper × arXiv1

信号强度SIGNALS

关键词热度
  • Whisper1
  • arXiv1

全部报道(1)SOURCES

A arXiv cs.CL en 2026-09-07 12:00

Automatic Speech Recognition for Multilingual Oral History Research

本文提出社区主导的文化遗产语言保护与复兴项目正采用语音技术。在新西兰粤语复兴中,口述历史作为关键的语言维护策略,其转录工作常因耗时耗力而受阻。自动语音识别(ASR)工具包如 Whisper 的开发加速了这一过程,但针对语码转换语境的有效性研究有限。基于字错率(WER),表现最佳的 Whisper 模型配置 WER 为 12.10,代价是未能准确转录非英语部分;尽管如此,该工具仍有用,仅需占手动转录预估时间的 1% 即可提供初稿转录。