🇦🇲 ArmBench-ASR: Benchmarking Speech-to-Text Models on Armenian

v1.0

WER across all datasets

Rank is based on Overall WER. Scores are percentages; lower is better.

34 models
Dataset
Metric across all datasets
RankModelAvailabilityCombinedCommon Voice 26FLEURSPoemsMoviesNews
#1
google/gemini-2.5-pro
Closed13.808.927.9120.0839.1911.26
#2
hispeech/model-23012026
Closed16.5610.9413.1322.6941.3514.36
#3
google/gemini-3-flash-preview
Closed16.6410.778.9924.3651.3811.06
#4
google/gemini-2.5-flash
Closed17.3512.2310.1024.8445.8713.47
#5
hispeech/model-01052025
Closed17.6310.0514.4122.9649.4917.75
#6
talk2edit
Closed17.6612.3010.0724.9746.1115.29
#7
elevenlabs/scribe_v2
Closed17.7412.109.4526.0749.8213.24
#8
wavam/default
Closed19.1311.4211.9130.4153.0015.67
#9
google/gemini-3.6-flash
Closed19.4216.0411.2425.8346.6412.93
#10
google/gemini-3.5-transcribe-preview
Closed19.5915.6810.9528.0446.4613.26
#11
nvidia/stt_hy_fastconformer_hybrid_large_pc
Open19.867.7015.0031.2860.7823.55
#12
wavam/streaming
Closed20.1812.2914.0031.0153.7516.84
#13
tbb-asr
Closed20.198.1515.5231.2461.6723.33
#14
google/gemini-3.1-flash-lite
Closed20.2716.3310.5126.0854.8612.92
#15
openai/gpt-transcribe
Closed22.4017.2815.3730.1751.9517.24
#16
NCCAIT/model-2024
Closed25.1716.1619.4933.6361.7625.83
#17
google/gemini-3.5-flash-lite
Closed26.0623.6914.3233.7256.0116.74
#18
deepgram/nova-3
Closed28.467.3133.5648.3575.8136.66
#19
facebook/seamless-m4t-v2-large
Open28.9415.1514.4443.9380.1637.43
#20
chillarmo/whisper-large-v3-turbo-armenian
Open33.0012.9424.6955.0982.0148.80
#21
arampacha/whisper-large-hy-2
Open33.1723.1617.3744.4877.8239.48
#22
modulate-velma-2-stt-batch-multilingual
Closed33.7127.3523.9537.5272.7333.77
#23
facebook/omniASR-LLM-3B
Open37.7627.4526.6849.8487.4335.18
#24
facebook/omniASR-LLM-1B
Open38.1028.0927.1849.0687.6435.78
#25
facebook/omniASR-CTC-3B
Open39.8530.5528.7551.7686.6436.14
#26
facebook/omniASR-CTC-1B
Open40.5033.7831.0147.0579.3738.35
#27
facebook/omniASR-LLM-300M
Open41.1030.7529.4053.6191.8338.06
#28
cast/whisper-large-v3-mwa-hy
Open41.4129.5930.6952.8975.0455.75
#29
facebook/mms-1b-all
Open47.5043.0934.5253.0483.3844.79
#30
facebook/omniASR-CTC-300M
Open50.6144.9240.2557.7986.5347.25
#31
google/gemma-4-e4b-it
Open50.6548.4837.1157.6279.7244.14
#32
google/gemma-4-e2b-it
Open53.4650.4442.7659.8880.1948.92
#33
modulate-velma-2-stt-batch-multilingual-vfast
Closed64.2362.4252.8063.00107.3053.91
#34
openai/whisper-large-v3
Open65.1261.6751.8471.10106.1755.25

Model comparison

Compare model error rates for one dataset and metric. Lower is better.

Cite ArmBench-ASR

If you use ArmBench-ASR in your research, please cite it as follows:

@misc{armbench-asr,
  title={ArmBench-ASR: Benchmarking Speech-to-Text Models on Armenian},
  author={Metric-AI-Lab},
  year={2026},
  howpublished={\url{https://metric-ai-armbench-asr.static.hf.space}},
  note={Benchmark for Evaluating Speech-to-Text Models on Armenian}
}