Chapter 18中文English测测你对课程内容的理解测测你对课程内容的理解 1. 什么是声码器(vocoder)? 2. Wav2Vec2模型采用了什么结构? 3. CTC算法中的空白标记(blank token)有什么作用? 。", explain: "" } ]} /> 4. 下列关于CTC模型的选项中哪一项是错误的? 5. Whisper模型使用了什么结构? 6. 解决音频分类任务的最简单方法是? 7. 以下陈述是否正确:当我们在时频谱上应用图像分类技巧时,我们可以使用常见的图像数据增强(Image data augmentation)方法,例如图像平移、裁切或改变大小,来提高模型的性能。上一章第3单元:音频Transformer架构下一章Seq2Seq结构