OpenTranscription
OpenTranscription
RankerModelosPlayground
OpenTranscription
OpenTranscription

Una API para cada modelo de voz a texto que vale la pena. Compáralos con tu audio, enruta al mejor, paga por segundo.

Estado de la plataforma

Producto

ClasificadorModelosTranscripcionesPlaygroundBlog

Desarrolladores

DocumentaciónConfiabilidadVersionado APIEstado

Legal

Política de PrivacidadTérminos de ServicioSoporte
© 2026 OpenTranscription
Volver a Modelos

Qwen3 ASR Flash vs GPT-4o Mini Transcribe

2 modelos comparados en el mismo benchmark — precisión, latencia, precio, cobertura de idiomas y capacidades. Qwen3 ASR Flash lidera en precisión; GPT-4o Mini Transcribe cubre más idiomas; Qwen3 ASR Flash es el más económico.

Abrir ambos en el playground

Veredicto · quién gana qué

Más preciso

Qwen3 ASR Flash

12.3% WER

Alibaba (Qwen)

Más rápido

—

—

Más idiomas

GPT-4o Mini Transcribe

98 idiomas

OpenAI

Más económico

Qwen3 ASR Flash

$0.0021/min

Alibaba (Qwen)

Comparando

2 modelos · mismo benchmark

1

Por lotes

Qwen3 ASR Flash

Alibaba (Qwen)

$0.0021/min
#5 · 69.1

Qwen3-ASR Flash de Alibaba — transcripción por lotes multilingüe (más de 25 idiomas) con marcas de tiempo por palabra y detección automática de idioma, alojado en Model Studio (Singapur). Admite archivos de hasta 12 horas.

Usar Este ModeloDetalles →

2

Por lotes

GPT-4o Mini Transcribe

OpenAI

$0.0030/min
#9 · 81.1

GPT-4o Mini optimizado para transcripción rápida

Usar Este ModeloDetalles →

Resumen

Promedio de benchmark 30 días

Puntuación general

0–100

69.1

81.1

Ranking de precisión

de 35

#5

#9

Tasa de error de palabras

WER

12.3%

13.6%

Tasa de error de caracteres

CER

7.4%

9.3%

Tasa de error de coincidencia

MER

11.2%

12.8%

Información de palabras perdida

WIL

14.3%

17.8%

Idiomas

25

98

Coste vs. precisión

WER general vs precio

GPT-4o Mini Transcribe

Qwen3 ASR Flash

grupo · 33 modelos

abajo a la izquierda es mejor

Precisión por categoría

WER · menor es mejor

code_switching

18.4%
18.6%

conversational

9.7%
12.4%

finance

6.0%

Precisión por acento

WER · inglés

african

24.6%
29.2%

australian

13.9%
12.3%

indian

20.6%

Velocidad y latencia

p50 → p99

Velocidad de procesamiento

× tiempo real

0.1×

0.1×

Latencia p50

7.0s

2.0s

Latencia p90

7.0s

2.4s

Tiempo real / streaming

Promedios del benchmark en streaming

Ranking en tiempo real

—

—

Puntuación en tiempo real

0–100

—

—

Tiempo hasta la primera palabra

—

—

Vaciado final

—

—

Factor de tiempo real

—

—

Parpadeo

—

—

Cadencia

—

—

Fiabilidad

Últimos 30 días

Disponibilidad

100.00%

100.00%

Tasa de error

0.00%

0.00%

Precios

facturado por segundo

Tarifa

por minuto

$0.0021

$0.0030

Granularidad de facturación

per 1s

per 1s

1 hora de audio

$0.13

$0.18

100 horas

Capacidades

Soporte de características

Diarización de hablantes

No

No

Marcas de tiempo por palabra

Yes

Yes

Cambio de código

No

Cobertura y despliegue

Idiomas · formatos · regiones

Idiomas

25

98

Modo

Por lotes

Por lotes

Región

Singapore

Estados Unidos

Formatos de audio

6.0%

general

11.3%
11.2%

legal

3.6%
4.9%

medical

7.0%
3.5%

noisy

29.2%
40.8%

technical

4.0%
4.0%
20.6%

uk

1.5%
7.5%

us

1.9%
18.9%

Latencia p99

7.0s

2.4s

$12.60

$18.00

1.000 horas

$126.00

$180.00

No

Detección automática de idioma

Yes

Yes

En tiempo real / streaming

No

No

Vocabulario personalizado

No

No

mp3
wav
flac
m4a
ogg
webm
aac
amr
mp3
wav
flac
m4a
ogg
webm

Tamaño máx. de archivo

2 GB

25 MB

Duración máx.

12 h

Sin límite

Cumplimiento normativo

—

SOC2
GDPR

Preguntas frecuentes

¿Es Qwen3 ASR Flash o GPT-4o Mini Transcribe más preciso?

Qwen3 ASR Flash es más preciso, con una tasa de error de palabras del 12.3% frente al 13.6% de GPT-4o Mini Transcribe, según nuestro benchmark estandarizado.

¿Cuál es más económico, Qwen3 ASR Flash o GPT-4o Mini Transcribe?

Qwen3 ASR Flash es más económico a $0.0021/min frente a $0.0030/min de GPT-4o Mini Transcribe.

¿Deberías elegir Qwen3 ASR Flash o GPT-4o Mini Transcribe?

Elige Qwen3 ASR Flash para precisión and menor coste; elige GPT-4o Mini Transcribe para cobertura de idiomas.