OpenTranscription
OpenTranscription
RankerModelosPlayground
OpenTranscription
OpenTranscription

Una API para cada modelo de voz a texto que vale la pena. Compáralos con tu audio, enruta al mejor, paga por segundo.

Estado de la plataforma

Producto

ClasificadorModelosTranscripcionesPlaygroundBlog

Desarrolladores

DocumentaciónConfiabilidadVersionado APIEstado

Legal

Política de PrivacidadTérminos de ServicioSoporte
© 2026 OpenTranscription
Volver a Modelos

Qwen3 ASR Flash vs GPT-4o Mini Transcribe

2 modelos comparados en el mismo benchmark — precisión, latencia, precio, cobertura de idiomas y capacidades. Qwen3 ASR Flash lidera en precisión; GPT-4o Mini Transcribe cubre más idiomas; Qwen3 ASR Flash es el más económico.

Abrir ambos en el playground

Veredicto · quién gana qué

Más preciso

Qwen3 ASR Flash

12.3% WER

Alibaba (Qwen)

Más rápido

—

—

Más idiomas

GPT-4o Mini Transcribe

98 idiomas

OpenAI

Más económico

Qwen3 ASR Flash

$0.0021/min

Alibaba (Qwen)

Comparando

2 modelos · mismo benchmark

1

Por lotes

Qwen3 ASR Flash

Alibaba (Qwen)

$0.0021/min
#5 · 69.1

Qwen3-ASR Flash de Alibaba — transcripción por lotes multilingüe (más de 25 idiomas) con marcas de tiempo por palabra y detección automática de idioma, alojado en Model Studio (Singapur). Admite archivos de hasta 12 horas.

Usar Este ModeloDetalles →

2

Por lotes

GPT-4o Mini Transcribe

OpenAI

$0.0030/min
#9 · 81.1

GPT-4o Mini optimizado para transcripción rápida

Usar Este ModeloDetalles →

Resumen

Promedio de benchmark 30 días

Puntuación general

0–100

69.1

81.1

Ranking de precisión

de 35

#5

#9

Tasa de error de palabras

WER

12.3%

13.6%

Tasa de error de caracteres

CER

7.4%

9.3%

Tasa de error de coincidencia

MER

11.2%

12.8%

Información de palabras perdida

WIL

14.3%

17.8%

Idiomas

25

98

Coste vs. precisión

WER general vs precio

GPT-4o Mini Transcribe

Qwen3 ASR Flash

grupo · 33 modelos

abajo a la izquierda es mejor

Precisión por categoría

WER · menor es mejor

code_switching

18.4%
18.6%

conversational

9.7%
12.4%

finance

6.0%
6.0%

general

11.3%
11.2%

legal

3.6%
4.9%

medical

7.0%
3.5%

noisy

29.2%
40.8%

technical

4.0%
4.0%

Precisión por acento

WER · inglés

african

24.6%
29.2%

australian

13.9%
12.3%

indian

20.6%
20.6%

uk

1.5%
7.5%

us

1.9%
18.9%

Velocidad y latencia

p50 → p99

Velocidad de procesamiento

× tiempo real

0.1×

0.1×

Latencia p50

7.0s

2.0s

Latencia p90

7.0s

2.4s

Latencia p99

7.0s

2.4s

Tiempo real / streaming

Promedios del benchmark en streaming

Ranking en tiempo real

—

—

Puntuación en tiempo real

0–100

—

—

Tiempo hasta la primera palabra

—

—

Vaciado final

—

—

Factor de tiempo real

—

—

Parpadeo

—

—

Cadencia

—

—

Fiabilidad

Últimos 30 días

Disponibilidad

100.00%

100.00%

Tasa de error

0.00%

0.00%

Precios

facturado por segundo

Tarifa

por minuto

$0.0021

$0.0030

Granularidad de facturación

per 1s

per 1s

1 hora de audio

$0.13

$0.18

100 horas

$12.60

$18.00

1.000 horas

$126.00

$180.00

Capacidades

Soporte de características

Diarización de hablantes

No

No

Marcas de tiempo por palabra

Yes

Yes

Cambio de código

No

No

Detección automática de idioma

Yes

Yes

En tiempo real / streaming

No

No

Vocabulario personalizado

No

No

Cobertura y despliegue

Idiomas · formatos · regiones

Idiomas

25

98

Modo

Por lotes

Por lotes

Región

Singapore

Estados Unidos

Formatos de audio

mp3
wav
flac
m4a
ogg
webm
aac
amr
mp3
wav
flac
m4a
ogg
webm

Tamaño máx. de archivo

2 GB

25 MB

Duración máx.

12 h

Sin límite

Cumplimiento normativo

—

SOC2
GDPR

Preguntas frecuentes

¿Es Qwen3 ASR Flash o GPT-4o Mini Transcribe más preciso?

Qwen3 ASR Flash es más preciso, con una tasa de error de palabras del 12.3% frente al 13.6% de GPT-4o Mini Transcribe, según nuestro benchmark estandarizado.

¿Cuál es más económico, Qwen3 ASR Flash o GPT-4o Mini Transcribe?

Qwen3 ASR Flash es más económico a $0.0021/min frente a $0.0030/min de GPT-4o Mini Transcribe.

¿Deberías elegir Qwen3 ASR Flash o GPT-4o Mini Transcribe?

Elige Qwen3 ASR Flash para precisión and menor coste; elige GPT-4o Mini Transcribe para cobertura de idiomas.