update vi
Browse files
model.py
CHANGED
|
@@ -397,39 +397,36 @@ def _get_offline_pre_trained_model(
|
|
| 397 |
def _get_vietnamese_pretrained_model(
|
| 398 |
repo_id: str, decoding_method: str, num_active_paths: int
|
| 399 |
) -> sherpa_onnx.OfflineRecognizer:
|
| 400 |
-
assert repo_id in (
|
| 401 |
-
"csukuangfj/sherpa-onnx-zipformer-vi-int8-2025-04-20",
|
| 402 |
-
"csukuangfj/sherpa-onnx-zipformer-vi-2025-04-20",
|
| 403 |
-
), repo_id
|
| 404 |
|
| 405 |
decoder_model = _get_nn_model_filename(
|
| 406 |
repo_id=repo_id,
|
| 407 |
-
filename="decoder-epoch-
|
| 408 |
subfolder=".",
|
| 409 |
)
|
| 410 |
|
| 411 |
-
if repo_id == "
|
| 412 |
encoder_model = _get_nn_model_filename(
|
| 413 |
repo_id=repo_id,
|
| 414 |
-
filename="encoder-epoch-
|
| 415 |
subfolder=".",
|
| 416 |
)
|
| 417 |
|
| 418 |
joiner_model = _get_nn_model_filename(
|
| 419 |
repo_id=repo_id,
|
| 420 |
-
filename="joiner-epoch-
|
| 421 |
subfolder=".",
|
| 422 |
)
|
| 423 |
-
elif repo_id == "
|
|
|
|
| 424 |
encoder_model = _get_nn_model_filename(
|
| 425 |
repo_id=repo_id,
|
| 426 |
-
filename="encoder-epoch-
|
| 427 |
subfolder=".",
|
| 428 |
)
|
| 429 |
|
| 430 |
joiner_model = _get_nn_model_filename(
|
| 431 |
repo_id=repo_id,
|
| 432 |
-
filename="joiner-epoch-
|
| 433 |
subfolder=".",
|
| 434 |
)
|
| 435 |
else:
|
|
@@ -2513,8 +2510,8 @@ thai_models = {
|
|
| 2513 |
}
|
| 2514 |
|
| 2515 |
vietnamese_models = {
|
| 2516 |
-
"
|
| 2517 |
-
"
|
| 2518 |
}
|
| 2519 |
|
| 2520 |
portuguese_brazlian_models = {
|
|
@@ -2553,30 +2550,5 @@ all_models = {
|
|
| 2553 |
}
|
| 2554 |
|
| 2555 |
language_to_models = {
|
| 2556 |
-
"Medical dictation English": list(medical_english_models.keys()),
|
| 2557 |
-
"31 languages (FunASR Nano)": list(funsar_nano_31_languages_models.keys()),
|
| 2558 |
-
"1600+ languages": list(more_than_1600_languages_models.keys()),
|
| 2559 |
-
"25 European languages": list(twenty_five_languages_models.keys()),
|
| 2560 |
-
"Multi-lingual (east aisa)": list(multi_lingual_models.keys()),
|
| 2561 |
-
"超多种中文方言": list(chinese_dialect_models.keys()),
|
| 2562 |
-
"Chinese": list(chinese_models.keys()),
|
| 2563 |
-
"English": list(english_models.keys()),
|
| 2564 |
-
"四川话": list(sichuan_models.keys()),
|
| 2565 |
-
"Chinese+English": list(chinese_english_mixed_models.keys()),
|
| 2566 |
-
"Chinese+English+Cantonese": list(chinese_cantonese_english_models.keys()),
|
| 2567 |
-
"Chinese+English+Cantonese+Japanese+Korean": list(
|
| 2568 |
-
chinese_cantonese_english_japanese_korean_models.keys()
|
| 2569 |
-
),
|
| 2570 |
-
"Arabic": list(arabic_models.keys()),
|
| 2571 |
-
"Cantonese": list(cantonese_models.keys()),
|
| 2572 |
-
"French": list(french_models.keys()),
|
| 2573 |
-
"German": list(german_models.keys()),
|
| 2574 |
-
"Japanese": list(japanese_models.keys()),
|
| 2575 |
-
"Korean": list(korean_models.keys()),
|
| 2576 |
-
"Portuguese (Brazil)": list(portuguese_brazlian_models.keys()),
|
| 2577 |
-
"Russian": list(russian_models.keys()),
|
| 2578 |
-
"Spanish": list(spanish_models.keys()),
|
| 2579 |
-
"Thai": list(thai_models.keys()),
|
| 2580 |
-
"Tibetan": list(tibetan_models.keys()),
|
| 2581 |
"Vietnamese": list(vietnamese_models.keys()),
|
| 2582 |
}
|
|
|
|
| 397 |
def _get_vietnamese_pretrained_model(
|
| 398 |
repo_id: str, decoding_method: str, num_active_paths: int
|
| 399 |
) -> sherpa_onnx.OfflineRecognizer:
|
|
|
|
|
|
|
|
|
|
|
|
|
| 400 |
|
| 401 |
decoder_model = _get_nn_model_filename(
|
| 402 |
repo_id=repo_id,
|
| 403 |
+
filename="decoder-epoch-20-avg-1.onnx",
|
| 404 |
subfolder=".",
|
| 405 |
)
|
| 406 |
|
| 407 |
+
if repo_id == "Audrey178/Vietasr-finetunning":
|
| 408 |
encoder_model = _get_nn_model_filename(
|
| 409 |
repo_id=repo_id,
|
| 410 |
+
filename="encoder-epoch-20-avg-1.int8.onnx",
|
| 411 |
subfolder=".",
|
| 412 |
)
|
| 413 |
|
| 414 |
joiner_model = _get_nn_model_filename(
|
| 415 |
repo_id=repo_id,
|
| 416 |
+
filename="joiner-epoch-20-avg-1.int8.onnx",
|
| 417 |
subfolder=".",
|
| 418 |
)
|
| 419 |
+
elif repo_id == "Audrey178/Vietasr-finetunning-non-int8":
|
| 420 |
+
repo_id = "Audrey178/Vietasr-finetunning"
|
| 421 |
encoder_model = _get_nn_model_filename(
|
| 422 |
repo_id=repo_id,
|
| 423 |
+
filename="encoder-epoch-20-avg-1.onnx",
|
| 424 |
subfolder=".",
|
| 425 |
)
|
| 426 |
|
| 427 |
joiner_model = _get_nn_model_filename(
|
| 428 |
repo_id=repo_id,
|
| 429 |
+
filename="joiner-epoch-20-avg-1.onnx",
|
| 430 |
subfolder=".",
|
| 431 |
)
|
| 432 |
else:
|
|
|
|
| 2510 |
}
|
| 2511 |
|
| 2512 |
vietnamese_models = {
|
| 2513 |
+
"Audrey178/Vietasr-finetunning": _get_vietnamese_pretrained_model,
|
| 2514 |
+
"Audrey178/Vietasr-finetunning-non-int8": _get_vietnamese_pretrained_model,
|
| 2515 |
}
|
| 2516 |
|
| 2517 |
portuguese_brazlian_models = {
|
|
|
|
| 2550 |
}
|
| 2551 |
|
| 2552 |
language_to_models = {
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| 2553 |
"Vietnamese": list(vietnamese_models.keys()),
|
| 2554 |
}
|