From 20c15d3aaafd68848bc87c65d4ce002abf2332dd Mon Sep 17 00:00:00 2001 From: fq Date: Tue, 11 Jul 2023 11:33:18 +0800 Subject: [PATCH] Update finetune_speech_recognition.py using the newest ASRDataset, and add download_mode for re-download the dataset(dataset is broken and so on) --- .../auto_speech_recognition/finetune_speech_recognition.py | 7 ++++--- 1 file changed, 4 insertions(+), 3 deletions(-) diff --git a/examples/pytorch/auto_speech_recognition/finetune_speech_recognition.py b/examples/pytorch/auto_speech_recognition/finetune_speech_recognition.py index 4d62f66f..ff06d4de 100644 --- a/examples/pytorch/auto_speech_recognition/finetune_speech_recognition.py +++ b/examples/pytorch/auto_speech_recognition/finetune_speech_recognition.py @@ -1,15 +1,16 @@ import os -from modelscope.metainfo import Trainers -from modelscope.msdatasets.audio.asr_dataset import ASRDataset +from modelscope.msdatasets.dataset_cls.custom_datasets import ASRDataset +from modelscope.utils.constant import DownloadMode from modelscope.trainers import build_trainer +from modelscope.metainfo import Trainers def modelscope_finetune(params): if not os.path.exists(params.output_dir): os.makedirs(params.output_dir, exist_ok=True) # dataset split ["train", "validation"] - ds_dict = ASRDataset.load(params.data_path, namespace='speech_asr') + ds_dict = MsDataset.load(params.data_path, namespace='speech_asr', download_mode=None) kwargs = dict( model=params.model, data_dir=ds_dict,