OpenTranscription
OpenTranscription
RankerModelosPlayground
OpenTranscription
OpenTranscription

Una API para cada modelo de voz a texto que vale la pena. Compáralos con tu audio, enruta al mejor, paga por segundo.

Estado de la plataforma

Producto

ClasificadorModelosTranscripcionesPlaygroundBlog

Desarrolladores

DocumentaciónConfiabilidadVersionado APIEstado

Legal

Política de PrivacidadTérminos de ServicioSoporte
© 2026 OpenTranscription
Volver a Modelos

Nova-3 vs Speechmatics Enhanced

2 modelos comparados en el mismo benchmark — precisión, latencia, precio, cobertura de idiomas y capacidades. Speechmatics Enhanced lidera en precisión; Speechmatics Enhanced es el más rápido; Speechmatics Enhanced cubre más idiomas; Nova-3 es el más económico.

Abrir ambos en el playground

Veredicto · quién gana qué

Más preciso

Speechmatics Enhanced

12.3% WER

Speechmatics

Más rápido

Speechmatics Enhanced

0.3× en tiempo real

Speechmatics

Más idiomas

Speechmatics Enhanced

48 idiomas

Speechmatics

Más económico

Nova-3

$0.0077/min

Deepgram

Comparando

2 modelos · mismo benchmark

1

Lotes y Tiempo real

Nova-3

Deepgram

$0.0077/min
#29 · 71.1

Modelo insignia de Deepgram — 53% menos WER vs competidores, soporte de cambio de código

Usar Este ModeloDetalles →

2

Por lotes

Speechmatics Enhanced

Speechmatics

$0.0083/min
#6 · 47.3

Modelo de mayor precisión — más de 55 idiomas, el mejor de su clase

Usar Este ModeloDetalles →

Resumen

Promedio de benchmark 30 días

Puntuación general

0–100

71.1

47.3

Ranking de precisión

de 35

#29

#6

Tasa de error de palabras

WER

21.0%

12.3%

Tasa de error de caracteres

CER

11.5%

8.0%

Tasa de error de coincidencia

MER

20.0%

11.3%

Información de palabras perdida

WIL

25.8%

16.2%

Idiomas

47

48

Coste vs. precisión

WER general vs precio

Speechmatics Enhanced

Nova-3

grupo · 33 modelos

abajo a la izquierda es mejor

Precisión por categoría

WER · menor es mejor

code_switching

63.0%
39.2%

conversational

12.2%
6.4%

finance

9.5%
6.8%

Precisión por acento

WER · inglés

african

26.2%
7.7%

australian

15.4%
7.7%

indian

27.0%
9.5%

Velocidad y latencia

p50 → p99

Velocidad de procesamiento

× tiempo real

0.1×

0.3×

Latencia p50

1.3s

8.7s

Latencia p90

1.8s

12.1s

Tiempo real / streaming

Promedios del benchmark en streaming

Ranking en tiempo real

de 17

#3

—

Puntuación en tiempo real

0–100

78.2

—

Tiempo hasta la primera palabra

973ms

—

Fiabilidad

Últimos 30 días

Disponibilidad

100.00%

100.00%

Tasa de error

0.00%

0.00%

Precios

facturado por segundo

Tarifa

por minuto

$0.0077

$0.0083

Granularidad de facturación

per 1s

per 1s

1 hora de audio

$0.46

$0.50

100 horas

Capacidades

Soporte de características

Diarización de hablantes

Yes

Yes

Marcas de tiempo por palabra

Yes

Yes

Cambio de código

Yes

Cobertura y despliegue

Idiomas · formatos · regiones

Idiomas

47

48

Modo

Lotes y Tiempo real

Por lotes

Región

Estados Unidos

Europa

Formatos de audio

general

23.4%
7.2%

legal

3.8%
2.2%

medical

9.5%
5.7%

noisy

21.8%
40.8%

technical

2.8%
5.3%

uk

6.0%
3.0%

us

11.3%
1.9%

Latencia p99

1.8s

12.1s

Vaciado final

181ms

—

Factor de tiempo real

1.01×

—

Parpadeo

9.6%

—

Cadencia

0.8/s

—

$46.08

$49.68

1.000 horas

$460.80

$496.80

Yes

Detección automática de idioma

Yes

Yes

En tiempo real / streaming

Yes

No

Vocabulario personalizado

Yes

Yes

mp3
wav
flac
m4a
ogg
webm
mp3
wav
flac
m4a
ogg

Tamaño máx. de archivo

2 GB

1 GB

Duración máx.

Sin límite

Sin límite

Cumplimiento normativo

HIPAA
SOC2
GDPR
SOC2
GDPR

Preguntas frecuentes

¿Es Nova-3 o Speechmatics Enhanced más preciso?

Speechmatics Enhanced es más preciso, con una tasa de error de palabras del 12.3% frente al 21.0% de Nova-3, según nuestro benchmark estandarizado.

¿Cuál es más económico, Nova-3 o Speechmatics Enhanced?

Nova-3 es más económico a $0.0077/min frente a $0.0083/min de Speechmatics Enhanced.

¿Deberías elegir Nova-3 o Speechmatics Enhanced?

Elige Nova-3 para menor coste; elige Speechmatics Enhanced para precisión, velocidad, and cobertura de idiomas.