Co-occurring keywords
Papers
SPLICEOUT: A Simple and Efficient Audio Augmentation Method
INTERSPEECH 2022
Exploring Capabilities of Monolingual Audio Transformers using Large Datasets in Automatic Speech Recognition of Czech
INTERSPEECH 2022
TALCS: An open-source Mandarin-English code-switching corpus and a speech recognition baseline
INTERSPEECH 2022
Self-regularised Minimum Latency Training for Streaming Transformer-based Speech Recognition
INTERSPEECH 2022
Open Source MagicData-RAMC: A Rich Annotated Mandarin Conversational(RAMC) Speech Dataset
INTERSPEECH 2022
Robust Self-Supervised Audio-Visual Speech Recognition
INTERSPEECH 2022
Transformer-Based Automatic Speech Recognition with Auxiliary Input of Source Language Text Toward Transcribing Simultaneous Interpretation
INTERSPEECH 2022
KSC2: An Industrial-Scale Open-Source Kazakh Speech Corpus
INTERSPEECH 2022
Training and typological bias in ASR performance for world Englishes
INTERSPEECH 2022
Lombard Effect for Bilingual Speakers in Cantonese and English: importance of spectro-temporal features
INTERSPEECH 2022
Speaker consistency loss and step-wise optimization for semi-supervised joint training of TTS and ASR using unpaired text data
INTERSPEECH 2022
SNRi Target Training for Joint Speech Enhancement and Recognition
INTERSPEECH 2022
Toward Fairness in Speech Recognition: Discovery and mitigation of performance disparities
INTERSPEECH 2022
A Unified Cascaded Encoder ASR Model for Dynamic Model Sizes
INTERSPEECH 2022
Partitioned Gradient Matching-based Data Subset Selection for Compute-Efficient Robust ASR Training
EMNLP 2022