Automatic Speech Recognition
Transformers
Safetensors
Sakizaya
whisper
formosanbank
formosan
endangered-languages
speech
asr
whisper-small
tacl
Instructions to use FormosanBank/formosan-asr-sakizaya with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use FormosanBank/formosan-asr-sakizaya with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("automatic-speech-recognition", model="FormosanBank/formosan-asr-sakizaya")# Load model directly from transformers import AutoProcessor, AutoModelForSpeechSeq2Seq processor = AutoProcessor.from_pretrained("FormosanBank/formosan-asr-sakizaya") model = AutoModelForSpeechSeq2Seq.from_pretrained("FormosanBank/formosan-asr-sakizaya", device_map="auto") - Notebooks
- Google Colab
- Kaggle
| { | |
| "code_git_commit": "9422e304f2cfa15c067d64bddea3cafbebaa09cc", | |
| "code_git_dirty": "unknown", | |
| "condition": "pan_formosan_to_language", | |
| "cuda_visible_devices": "0", | |
| "dataset_version": "dataset_v1", | |
| "dev_corpus": "", | |
| "dev_hours": 1.946087, | |
| "dev_language": "sakizaya", | |
| "dev_rows": 1107, | |
| "dev_scope": "language_pooled", | |
| "device": "cuda", | |
| "effective_eval_every_steps": 661, | |
| "effective_max_steps": 3305, | |
| "eval_batch_size": 4, | |
| "eval_corpus": "", | |
| "eval_every_steps": 661, | |
| "eval_language": "sakizaya", | |
| "eval_scope": "language_pooled", | |
| "freeze_encoder": false, | |
| "generated_at": "2026-06-25T20:22:58+00:00", | |
| "gradient_checkpointing": true, | |
| "hostname": "g010", | |
| "learning_rate": 1e-05, | |
| "max_eval_batches": 0, | |
| "max_new_tokens": 160, | |
| "max_steps": 500, | |
| "model_family": "whisper_small", | |
| "model_id": "/scratch/scheppat/projects/tacl_formosan_asr/runs_whisper_final_v1/whisper_small_pan_formosan_direct_train-all_eval-all-all-corpora_dataset_v1_split_v2_formosan_safe_v1_seed13/best_model", | |
| "model_revision": "", | |
| "normalization_version": "formosan_safe_v1", | |
| "num_beams": 1, | |
| "package_freeze": [ | |
| "absl-py==2.4.0", | |
| "accelerate==1.1.1", | |
| "aiohappyeyeballs==2.6.2", | |
| "aiohttp==3.14.1", | |
| "aiosignal==1.4.0", | |
| "async-timeout==5.0.1", | |
| "attrs==26.1.0", | |
| "audioread==3.1.0", | |
| "certifi==2026.6.17", | |
| "cffi==2.0.0", | |
| "charset-normalizer==3.4.7", | |
| "click==8.4.1", | |
| "datasets==3.1.0", | |
| "decorator==5.3.1", | |
| "dill==0.3.8", | |
| "evaluate==0.4.3", | |
| "filelock==3.29.0", | |
| "frozenlist==1.8.0", | |
| "fsspec==2024.9.0", | |
| "grpcio==1.81.1", | |
| "hf-xet==1.5.1", | |
| "huggingface_hub==0.36.2", | |
| "idna==3.18", | |
| "Jinja2==3.1.6", | |
| "jiwer==3.0.5", | |
| "joblib==1.5.3", | |
| "lazy-loader==0.5", | |
| "librosa==0.10.2.post1", | |
| "llvmlite==0.47.0", | |
| "Markdown==3.10.2", | |
| "MarkupSafe==3.0.3", | |
| "mpmath==1.3.0", | |
| "msgpack==1.2.1", | |
| "multidict==6.7.1", | |
| "multiprocess==0.70.16", | |
| "networkx==3.4.2", | |
| "numba==0.65.1", | |
| "numpy==2.2.6", | |
| "nvidia-cublas-cu12==12.4.5.8", | |
| "nvidia-cuda-cupti-cu12==12.4.127", | |
| "nvidia-cuda-nvrtc-cu12==12.4.127", | |
| "nvidia-cuda-runtime-cu12==12.4.127", | |
| "nvidia-cudnn-cu12==9.1.0.70", | |
| "nvidia-cufft-cu12==11.2.1.3", | |
| "nvidia-curand-cu12==10.3.5.147", | |
| "nvidia-cusolver-cu12==11.6.1.9", | |
| "nvidia-cusparse-cu12==12.3.1.170", | |
| "nvidia-nccl-cu12==2.21.5", | |
| "nvidia-nvjitlink-cu12==12.4.127", | |
| "nvidia-nvtx-cu12==12.4.127", | |
| "packaging @ file:///home/conda/feedstock_root/build_artifacts/bld/rattler-build_packaging_1777103621/work", | |
| "pandas==2.3.3", | |
| "platformdirs==4.10.0", | |
| "pooch==1.9.0", | |
| "propcache==0.5.2", | |
| "protobuf==7.35.1", | |
| "psutil==7.2.2", | |
| "pyarrow==24.0.0", | |
| "pycparser==3.0", | |
| "python-dateutil==2.9.0.post0", | |
| "pytz==2026.2", | |
| "PyYAML==6.0.3", | |
| "RapidFuzz==3.14.5", | |
| "regex==2026.5.9", | |
| "requests==2.34.2", | |
| "safetensors==0.8.0", | |
| "scikit-learn==1.7.2", | |
| "scipy==1.15.3", | |
| "sentencepiece==0.2.0", | |
| "six==1.17.0", | |
| "soundfile==0.12.1", | |
| "soxr==1.1.0", | |
| "sympy==1.13.1", | |
| "tensorboard==2.18.0", | |
| "tensorboard-data-server==0.7.2", | |
| "threadpoolctl==3.6.0", | |
| "tokenizers==0.20.3", | |
| "torch==2.5.1+cu124", | |
| "torchaudio==2.5.1+cu124", | |
| "tqdm==4.68.3", | |
| "transformers==4.46.3", | |
| "triton==3.1.0", | |
| "typing_extensions==4.15.0", | |
| "tzdata==2026.2", | |
| "urllib3==2.7.0", | |
| "Werkzeug==3.1.8", | |
| "xxhash==3.7.0", | |
| "yarl==1.24.2" | |
| ], | |
| "package_freeze_count": 88, | |
| "pretraining_checkpoint_path": "", | |
| "pretraining_condition": "", | |
| "pretraining_manifest": "", | |
| "pretraining_model_revision": "", | |
| "pretraining_run_id": "", | |
| "pretraining_source_policy": "", | |
| "python_argv": [ | |
| "/projects/prudlab/tacl_formosan_asr/code/tacl_pipeline/src/tacl_formosan_asr/train_whisper_asr.py", | |
| "--source-root", | |
| "/projects/prudlab/hunter_formosan_audio", | |
| "--run-dir", | |
| "/projects/prudlab/tacl_formosan_asr/experiments/manifests/gate5_whisper_final_v1_with_pan_checkpoint/whisper_small_pan_formosan_to_language_train-sakizaya_eval-sakizaya-all-corpora_dataset_v1_split_v2_formosan_safe_v1_seed13", | |
| "--out-dir", | |
| "/scratch/scheppat/projects/tacl_formosan_asr/runs_whisper_final_v1/whisper_small_pan_formosan_to_language_train-sakizaya_eval-sakizaya-all-corpora_dataset_v1_split_v2_formosan_safe_v1_seed13", | |
| "--run-id", | |
| "whisper_small_pan_formosan_to_language_train-sakizaya_eval-sakizaya-all-corpora_dataset_v1_split_v2_formosan_safe_v1_seed13", | |
| "--model-id", | |
| "/scratch/scheppat/projects/tacl_formosan_asr/runs_whisper_final_v1/whisper_small_pan_formosan_direct_train-all_eval-all-all-corpora_dataset_v1_split_v2_formosan_safe_v1_seed13/best_model", | |
| "--model-revision", | |
| "", | |
| "--seed", | |
| "13", | |
| "--max-steps", | |
| "500", | |
| "--train-epochs", | |
| "3", | |
| "--train-batch-size", | |
| "8", | |
| "--eval-batch-size", | |
| "4", | |
| "--learning-rate", | |
| "1e-5", | |
| "--eval-every-steps", | |
| "0", | |
| "--max-eval-batches", | |
| "0", | |
| "--max-train-rows", | |
| "0", | |
| "--max-dev-rows", | |
| "0", | |
| "--max-test-rows", | |
| "0", | |
| "--max-new-tokens", | |
| "160", | |
| "--num-beams", | |
| "1", | |
| "--save-best-model", | |
| "--gradient-checkpointing" | |
| ], | |
| "python_executable": "/scratch/scheppat/projects/tacl_formosan_asr/conda/tacl_asr_py310/bin/python", | |
| "python_version": "3.10.20 | packaged by conda-forge | (main, Jun 11 2026, 03:31:56) [GCC 14.3.0]", | |
| "requested_eval_every_steps": 0, | |
| "run_dir": "/projects/prudlab/tacl_formosan_asr/experiments/manifests/gate5_whisper_final_v1_with_pan_checkpoint/whisper_small_pan_formosan_to_language_train-sakizaya_eval-sakizaya-all-corpora_dataset_v1_split_v2_formosan_safe_v1_seed13", | |
| "run_id": "whisper_small_pan_formosan_to_language_train-sakizaya_eval-sakizaya-all-corpora_dataset_v1_split_v2_formosan_safe_v1_seed13", | |
| "seed": 13, | |
| "slurm_job_id": "2636589", | |
| "slurm_job_name": "tacl_whisper_registry_array", | |
| "split_version": "split_v2", | |
| "status": "planned", | |
| "tacl_code_version_file": "9422e304f2cfa15c067d64bddea3cafbebaa09cc", | |
| "test_hours": 1.94549, | |
| "test_rows": 1106, | |
| "train_batch_size": 8, | |
| "train_corpus": "", | |
| "train_corpus_counts": { | |
| "ILRDF": 4211, | |
| "NTU": 681, | |
| "ePark1": 801, | |
| "ePark2": 491, | |
| "ePark3": 2627 | |
| }, | |
| "train_epochs": 3.0, | |
| "train_hours": 15.580032, | |
| "train_language": "sakizaya", | |
| "train_rows": 8811, | |
| "train_scope": "language_pooled", | |
| "vocab_scope": "pan_formosan" | |
| } | |