2 modelos comparados en el mismo benchmark — precisión, latencia, precio, cobertura de idiomas y capacidades. Qwen3 ASR Flash lidera en precisión; Whisper Large V3 es el más rápido; Whisper Large V3 cubre más idiomas; Qwen3 ASR Flash es el más económico.
Veredicto · quién gana qué
Más preciso
Qwen3 ASR Flash
12.3% WER
Alibaba (Qwen)
Más rápido
Whisper Large V3
0.3× en tiempo real
OpenAI
Más idiomas
Whisper Large V3
98 idiomas
OpenAI
Más económico
Qwen3 ASR Flash
$0.0021/min
Alibaba (Qwen)
Comparando
2 modelos · mismo benchmark
1
Qwen3 ASR Flash
Alibaba (Qwen)
Qwen3-ASR Flash de Alibaba — transcripción por lotes multilingüe (más de 25 idiomas) con marcas de tiempo por palabra y detección automática de idioma, alojado en Model Studio (Singapur). Admite archivos de hasta 12 horas.
2
Whisper Large V3
OpenAI
Modelo Whisper large-v3 de OpenAI
Qwen3 ASR Flash
Whisper Large V3
grupo · 33 modelos
abajo a la izquierda es mejor
general
legal
medical
noisy
technical
uk
us
Latencia p99
7.0s
4.3s
$12.60
$36.00
1.000 horas
$126.00
$360.00
No
Detección automática de idioma
Yes
Yes
En tiempo real / streaming
No
No
Vocabulario personalizado
No
No
Tamaño máx. de archivo
2 GB
25 MB
Duración máx.
12 h
Sin límite
Cumplimiento normativo
—
¿Es Qwen3 ASR Flash o Whisper Large V3 más preciso?
Qwen3 ASR Flash es más preciso, con una tasa de error de palabras del 12.3% frente al 17.7% de Whisper Large V3, según nuestro benchmark estandarizado.
¿Cuál es más económico, Qwen3 ASR Flash o Whisper Large V3?
Qwen3 ASR Flash es más económico a $0.0021/min frente a $0.0060/min de Whisper Large V3.
¿Deberías elegir Qwen3 ASR Flash o Whisper Large V3?
Elige Qwen3 ASR Flash para precisión and menor coste; elige Whisper Large V3 para velocidad and cobertura de idiomas.