diff --git a/dataset/create_dataset.py b/dataset/create_dataset.py index e00d6ee..b14aa5c 100644 --- a/dataset/create_dataset.py +++ b/dataset/create_dataset.py @@ -8,6 +8,7 @@ sys.path.append(dirname(dirname(abspath(__file__)))) from dataset.audio_processing import convert_audio from dataset.clip_generator import clip_generator from dataset.analysis import save_dataset_info +from dataset.transcribe import create_transcription_model def create_dataset( @@ -82,4 +83,4 @@ if __name__ == "__main__": parser.add_argument("-i", "--info_path", help="Path to save info file", type=str, default="info.json") args = parser.parse_args() - create_dataset(**vars(args)) + create_dataset(**vars(args), transcription_model=create_transcription_model()) diff --git a/dataset/transcribe.py b/dataset/transcribe.py index aee982d..1e24836 100644 --- a/dataset/transcribe.py +++ b/dataset/transcribe.py @@ -118,5 +118,6 @@ if __name__ == "__main__": parser.add_argument("-i", "--input_path", help="Path to audio file", type=str, required=True) args = parser.parse_args() - text = transcribe(args.input_path) + model = create_transcription_model() + text = model.transcribe(args.input_path) print("Text: ", text)