OpenTranscription
OpenTranscription
RankerModelosPlayground
OpenTranscription
OpenTranscription

Una API para cada modelo de voz a texto que vale la pena. Compáralos con tu audio, enruta al mejor, paga por segundo.

Estado de la plataforma

Producto

ClasificadorModelosTranscripcionesPlaygroundBlog

Desarrolladores

DocumentaciónConfiabilidadVersionado APIEstado

Legal

Política de PrivacidadTérminos de ServicioSoporte
© 2026 OpenTranscription
Volver a Modelos

Qwen3 ASR Flash vs Speechmatics Standard

2 modelos comparados en el mismo benchmark — precisión, latencia, precio, cobertura de idiomas y capacidades. Qwen3 ASR Flash lidera en precisión; Speechmatics Standard cubre más idiomas; Qwen3 ASR Flash es el más económico.

Abrir ambos en el playground

Veredicto · quién gana qué

Más preciso

Qwen3 ASR Flash

12.3% WER

Alibaba (Qwen)

Más rápido

—

—

Más idiomas

Speechmatics Standard

48 idiomas

Speechmatics

Más económico

Qwen3 ASR Flash

$0.0021/min

Alibaba (Qwen)

Comparando

2 modelos · mismo benchmark

1

Por lotes

Qwen3 ASR Flash

Alibaba (Qwen)

$0.0021/min
#5 · 69.1

Qwen3-ASR Flash de Alibaba — transcripción por lotes multilingüe (más de 25 idiomas) con marcas de tiempo por palabra y detección automática de idioma, alojado en Model Studio (Singapur). Admite archivos de hasta 12 horas.

Usar Este ModeloDetalles →

2

Por lotes

Speechmatics Standard

Speechmatics

$0.0050/min
#13 · 60.9

Modelo económico — respuesta rápida, más de 55 idiomas

Usar Este ModeloDetalles →

Resumen

Promedio de benchmark 30 días

Puntuación general

0–100

69.1

60.9

Ranking de precisión

de 35

#5

#13

Tasa de error de palabras

WER

12.3%

14.7%

Tasa de error de caracteres

CER

7.4%

9.8%

Tasa de error de coincidencia

MER

11.2%

13.8%

Información de palabras perdida

WIL

14.3%

19.3%

Idiomas

25

48

Coste vs. precisión

WER general vs precio

Qwen3 ASR Flash

Speechmatics Standard

grupo · 33 modelos

abajo a la izquierda es mejor

Precisión por categoría

WER · menor es mejor

code_switching

18.4%
54.2%

conversational

9.7%
7.3%

finance

6.0%

Precisión por acento

WER · inglés

african

24.6%
13.9%

australian

13.9%
13.9%

indian

20.6%
6.3%

Velocidad y latencia

p50 → p99

Velocidad de procesamiento

× tiempo real

0.1×

0.1×

Latencia p50

7.0s

7.1s

Latencia p90

7.0s

7.3s

Tiempo real / streaming

Promedios del benchmark en streaming

Ranking en tiempo real

—

—

Puntuación en tiempo real

0–100

—

—

Tiempo hasta la primera palabra

—

—

Vaciado final

—

—

Factor de tiempo real

—

—

Parpadeo

—

—

Cadencia

—

—

Fiabilidad

Últimos 30 días

Disponibilidad

100.00%

100.00%

Tasa de error

0.00%

0.00%

Precios

facturado por segundo

Tarifa

por minuto

$0.0021

$0.0050

Granularidad de facturación

per 1s

per 1s

1 hora de audio

$0.13

$0.30

100 horas

Capacidades

Soporte de características

Diarización de hablantes

No

Yes

Marcas de tiempo por palabra

Yes

Yes

Cambio de código

No

Cobertura y despliegue

Idiomas · formatos · regiones

Idiomas

25

48

Modo

Por lotes

Por lotes

Región

Singapore

Europa

Formatos de audio

7.9%

general

11.3%
7.4%

legal

3.6%
4.0%

medical

7.0%
7.8%

noisy

29.2%
50.3%

technical

4.0%
4.6%

uk

1.5%
0.0%

us

1.9%
3.8%

Latencia p99

7.0s

7.3s

$12.60

$29.88

1.000 horas

$126.00

$298.80

Yes

Detección automática de idioma

Yes

Yes

En tiempo real / streaming

No

No

Vocabulario personalizado

No

Yes

mp3
wav
flac
m4a
ogg
webm
aac
amr
mp3
wav
flac
m4a
ogg

Tamaño máx. de archivo

2 GB

1 GB

Duración máx.

12 h

Sin límite

Cumplimiento normativo

—

SOC2
GDPR

Preguntas frecuentes

¿Es Qwen3 ASR Flash o Speechmatics Standard más preciso?

Qwen3 ASR Flash es más preciso, con una tasa de error de palabras del 12.3% frente al 14.7% de Speechmatics Standard, según nuestro benchmark estandarizado.

¿Cuál es más económico, Qwen3 ASR Flash o Speechmatics Standard?

Qwen3 ASR Flash es más económico a $0.0021/min frente a $0.0050/min de Speechmatics Standard.

¿Deberías elegir Qwen3 ASR Flash o Speechmatics Standard?

Elige Qwen3 ASR Flash para precisión and menor coste; elige Speechmatics Standard para cobertura de idiomas.