OpenTranscription
OpenTranscription
RankerModelosPlayground
OpenTranscription
OpenTranscription

Una API para cada modelo de voz a texto que vale la pena. Compáralos con tu audio, enruta al mejor, paga por segundo.

Estado de la plataforma

Producto

ClasificadorModelosTranscripcionesPlaygroundBlog

Desarrolladores

DocumentaciónConfiabilidadVersionado APIEstado

Legal

Política de PrivacidadTérminos de ServicioSoporte
© 2026 OpenTranscription
Volver a Modelos

Qwen3 ASR Flash vs Speechmatics Standard

2 modelos comparados en el mismo benchmark — precisión, latencia, precio, cobertura de idiomas y capacidades. Qwen3 ASR Flash lidera en precisión; Speechmatics Standard cubre más idiomas; Qwen3 ASR Flash es el más económico.

Abrir ambos en el playground

Veredicto · quién gana qué

Más preciso

Qwen3 ASR Flash

12.3% WER

Alibaba (Qwen)

Más rápido

—

—

Más idiomas

Speechmatics Standard

48 idiomas

Speechmatics

Más económico

Qwen3 ASR Flash

$0.0021/min

Alibaba (Qwen)

Comparando

2 modelos · mismo benchmark

1

Por lotes

Qwen3 ASR Flash

Alibaba (Qwen)

$0.0021/min
#5 · 69.1

Qwen3-ASR Flash de Alibaba — transcripción por lotes multilingüe (más de 25 idiomas) con marcas de tiempo por palabra y detección automática de idioma, alojado en Model Studio (Singapur). Admite archivos de hasta 12 horas.

Usar Este ModeloDetalles →

2

Por lotes

Speechmatics Standard

Speechmatics

$0.0050/min
#13 · 60.9

Modelo económico — respuesta rápida, más de 55 idiomas

Usar Este ModeloDetalles →

Resumen

Promedio de benchmark 30 días

Puntuación general

0–100

69.1

60.9

Ranking de precisión

de 35

#5

#13

Tasa de error de palabras

WER

12.3%

14.7%

Tasa de error de caracteres

CER

7.4%

9.8%

Tasa de error de coincidencia

MER

11.2%

13.8%

Información de palabras perdida

WIL

14.3%

19.3%

Idiomas

25

48

Coste vs. precisión

WER general vs precio

Qwen3 ASR Flash

Speechmatics Standard

grupo · 33 modelos

abajo a la izquierda es mejor

Precisión por categoría

WER · menor es mejor

code_switching

18.4%
54.2%

conversational

9.7%
7.3%

finance

6.0%
7.9%

general

11.3%
7.4%

legal

3.6%
4.0%

medical

7.0%
7.8%

noisy

29.2%
50.3%

technical

4.0%
4.6%

Precisión por acento

WER · inglés

african

24.6%
13.9%

australian

13.9%
13.9%

indian

20.6%
6.3%

uk

1.5%
0.0%

us

1.9%
3.8%

Velocidad y latencia

p50 → p99

Velocidad de procesamiento

× tiempo real

0.1×

0.1×

Latencia p50

7.0s

7.1s

Latencia p90

7.0s

7.3s

Latencia p99

7.0s

7.3s

Tiempo real / streaming

Promedios del benchmark en streaming

Ranking en tiempo real

—

—

Puntuación en tiempo real

0–100

—

—

Tiempo hasta la primera palabra

—

—

Vaciado final

—

—

Factor de tiempo real

—

—

Parpadeo

—

—

Cadencia

—

—

Fiabilidad

Últimos 30 días

Disponibilidad

100.00%

100.00%

Tasa de error

0.00%

0.00%

Precios

facturado por segundo

Tarifa

por minuto

$0.0021

$0.0050

Granularidad de facturación

per 1s

per 1s

1 hora de audio

$0.13

$0.30

100 horas

$12.60

$29.88

1.000 horas

$126.00

$298.80

Capacidades

Soporte de características

Diarización de hablantes

No

Yes

Marcas de tiempo por palabra

Yes

Yes

Cambio de código

No

Yes

Detección automática de idioma

Yes

Yes

En tiempo real / streaming

No

No

Vocabulario personalizado

No

Yes

Cobertura y despliegue

Idiomas · formatos · regiones

Idiomas

25

48

Modo

Por lotes

Por lotes

Región

Singapore

Europa

Formatos de audio

mp3
wav
flac
m4a
ogg
webm
aac
amr
mp3
wav
flac
m4a
ogg

Tamaño máx. de archivo

2 GB

1 GB

Duración máx.

12 h

Sin límite

Cumplimiento normativo

—

SOC2
GDPR

Preguntas frecuentes

¿Es Qwen3 ASR Flash o Speechmatics Standard más preciso?

Qwen3 ASR Flash es más preciso, con una tasa de error de palabras del 12.3% frente al 14.7% de Speechmatics Standard, según nuestro benchmark estandarizado.

¿Cuál es más económico, Qwen3 ASR Flash o Speechmatics Standard?

Qwen3 ASR Flash es más económico a $0.0021/min frente a $0.0050/min de Speechmatics Standard.

¿Deberías elegir Qwen3 ASR Flash o Speechmatics Standard?

Elige Qwen3 ASR Flash para precisión and menor coste; elige Speechmatics Standard para cobertura de idiomas.