Audrey178 commited on
Commit
e835f31
·
1 Parent(s): 8268a0d

update vi

Browse files
Files changed (1) hide show
  1. model.py +10 -38
model.py CHANGED
@@ -397,39 +397,36 @@ def _get_offline_pre_trained_model(
397
  def _get_vietnamese_pretrained_model(
398
  repo_id: str, decoding_method: str, num_active_paths: int
399
  ) -> sherpa_onnx.OfflineRecognizer:
400
- assert repo_id in (
401
- "csukuangfj/sherpa-onnx-zipformer-vi-int8-2025-04-20",
402
- "csukuangfj/sherpa-onnx-zipformer-vi-2025-04-20",
403
- ), repo_id
404
 
405
  decoder_model = _get_nn_model_filename(
406
  repo_id=repo_id,
407
- filename="decoder-epoch-12-avg-8.onnx",
408
  subfolder=".",
409
  )
410
 
411
- if repo_id == "csukuangfj/sherpa-onnx-zipformer-vi-int8-2025-04-20":
412
  encoder_model = _get_nn_model_filename(
413
  repo_id=repo_id,
414
- filename="encoder-epoch-12-avg-8.int8.onnx",
415
  subfolder=".",
416
  )
417
 
418
  joiner_model = _get_nn_model_filename(
419
  repo_id=repo_id,
420
- filename="joiner-epoch-12-avg-8.int8.onnx",
421
  subfolder=".",
422
  )
423
- elif repo_id == "csukuangfj/sherpa-onnx-zipformer-vi-2025-04-20":
 
424
  encoder_model = _get_nn_model_filename(
425
  repo_id=repo_id,
426
- filename="encoder-epoch-12-avg-8.onnx",
427
  subfolder=".",
428
  )
429
 
430
  joiner_model = _get_nn_model_filename(
431
  repo_id=repo_id,
432
- filename="joiner-epoch-12-avg-8.onnx",
433
  subfolder=".",
434
  )
435
  else:
@@ -2513,8 +2510,8 @@ thai_models = {
2513
  }
2514
 
2515
  vietnamese_models = {
2516
- "csukuangfj/sherpa-onnx-zipformer-vi-int8-2025-04-20": _get_vietnamese_pretrained_model,
2517
- "csukuangfj/sherpa-onnx-zipformer-vi-2025-04-20": _get_vietnamese_pretrained_model,
2518
  }
2519
 
2520
  portuguese_brazlian_models = {
@@ -2553,30 +2550,5 @@ all_models = {
2553
  }
2554
 
2555
  language_to_models = {
2556
- "Medical dictation English": list(medical_english_models.keys()),
2557
- "31 languages (FunASR Nano)": list(funsar_nano_31_languages_models.keys()),
2558
- "1600+ languages": list(more_than_1600_languages_models.keys()),
2559
- "25 European languages": list(twenty_five_languages_models.keys()),
2560
- "Multi-lingual (east aisa)": list(multi_lingual_models.keys()),
2561
- "超多种中文方言": list(chinese_dialect_models.keys()),
2562
- "Chinese": list(chinese_models.keys()),
2563
- "English": list(english_models.keys()),
2564
- "四川话": list(sichuan_models.keys()),
2565
- "Chinese+English": list(chinese_english_mixed_models.keys()),
2566
- "Chinese+English+Cantonese": list(chinese_cantonese_english_models.keys()),
2567
- "Chinese+English+Cantonese+Japanese+Korean": list(
2568
- chinese_cantonese_english_japanese_korean_models.keys()
2569
- ),
2570
- "Arabic": list(arabic_models.keys()),
2571
- "Cantonese": list(cantonese_models.keys()),
2572
- "French": list(french_models.keys()),
2573
- "German": list(german_models.keys()),
2574
- "Japanese": list(japanese_models.keys()),
2575
- "Korean": list(korean_models.keys()),
2576
- "Portuguese (Brazil)": list(portuguese_brazlian_models.keys()),
2577
- "Russian": list(russian_models.keys()),
2578
- "Spanish": list(spanish_models.keys()),
2579
- "Thai": list(thai_models.keys()),
2580
- "Tibetan": list(tibetan_models.keys()),
2581
  "Vietnamese": list(vietnamese_models.keys()),
2582
  }
 
397
  def _get_vietnamese_pretrained_model(
398
  repo_id: str, decoding_method: str, num_active_paths: int
399
  ) -> sherpa_onnx.OfflineRecognizer:
 
 
 
 
400
 
401
  decoder_model = _get_nn_model_filename(
402
  repo_id=repo_id,
403
+ filename="decoder-epoch-20-avg-1.onnx",
404
  subfolder=".",
405
  )
406
 
407
+ if repo_id == "Audrey178/Vietasr-finetunning":
408
  encoder_model = _get_nn_model_filename(
409
  repo_id=repo_id,
410
+ filename="encoder-epoch-20-avg-1.int8.onnx",
411
  subfolder=".",
412
  )
413
 
414
  joiner_model = _get_nn_model_filename(
415
  repo_id=repo_id,
416
+ filename="joiner-epoch-20-avg-1.int8.onnx",
417
  subfolder=".",
418
  )
419
+ elif repo_id == "Audrey178/Vietasr-finetunning-non-int8":
420
+ repo_id = "Audrey178/Vietasr-finetunning"
421
  encoder_model = _get_nn_model_filename(
422
  repo_id=repo_id,
423
+ filename="encoder-epoch-20-avg-1.onnx",
424
  subfolder=".",
425
  )
426
 
427
  joiner_model = _get_nn_model_filename(
428
  repo_id=repo_id,
429
+ filename="joiner-epoch-20-avg-1.onnx",
430
  subfolder=".",
431
  )
432
  else:
 
2510
  }
2511
 
2512
  vietnamese_models = {
2513
+ "Audrey178/Vietasr-finetunning": _get_vietnamese_pretrained_model,
2514
+ "Audrey178/Vietasr-finetunning-non-int8": _get_vietnamese_pretrained_model,
2515
  }
2516
 
2517
  portuguese_brazlian_models = {
 
2550
  }
2551
 
2552
  language_to_models = {
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
2553
  "Vietnamese": list(vietnamese_models.keys()),
2554
  }