OpenTranscription
OpenTranscription
RankerModelosPlayground
OpenTranscription
OpenTranscription

Una API para cada modelo de voz a texto que vale la pena. Compáralos con tu audio, enruta al mejor, paga por segundo.

Estado de la plataforma

Producto

ClasificadorModelosTranscripcionesPlaygroundBlog

Desarrolladores

DocumentaciónConfiabilidadVersionado APIEstado

Legal

Política de PrivacidadTérminos de ServicioSoporte
© 2026 OpenTranscription
Volver a Modelos

Nova-2 vs Whisper Large V3

2 modelos comparados en el mismo benchmark — precisión, latencia, precio, cobertura de idiomas y capacidades. Whisper Large V3 lidera en precisión; Nova-2 es el más rápido; Nova-2 cubre más idiomas; Whisper Large V3 es el más económico.

Abrir ambos en el playground

Veredicto · quién gana qué

Más preciso

Whisper Large V3

14.4% WER

Groq

Más rápido

Nova-2

0.1× en tiempo real

Deepgram

Más idiomas

Nova-2

33 idiomas

Deepgram

Más económico

Whisper Large V3

$0.0019/min

Groq

Comparando

2 modelos · mismo benchmark

1

Lotes y Tiempo real

Nova-2

Deepgram

$0.0058/min
#18 · 76.2

Reconocimiento de voz Nova-2 de Deepgram

Usar Este ModeloDetalles →

2

Por lotes

Whisper Large V3

Groq

$0.0019/min
#11 · 79.9

Whisper large-v3 de OpenAI ejecutado en el hardware LPU de Groq — la mejor precisión de Whisper a la velocidad y el costo de Groq, con marcas de tiempo por palabra y detección automática de idioma.

Usar Este ModeloDetalles →

Resumen

Promedio de benchmark 30 días

Puntuación general

0–100

76.2

79.9

Ranking de precisión

de 35

#18

#11

Tasa de error de palabras

WER

16.5%

14.4%

Tasa de error de caracteres

CER

11.9%

11.2%

Tasa de error de coincidencia

MER

15.4%

13.3%

Información de palabras perdida

WIL

21.0%

18.2%

Idiomas

33

12

Coste vs. precisión

WER general vs precio

Nova-2

Whisper Large V3

grupo · 33 modelos

abajo a la izquierda es mejor

Precisión por categoría

WER · menor es mejor

code_switching

63.7%
68.5%

conversational

10.2%
10.9%

finance

11.3%
6.4%

Precisión por acento

WER · inglés

african

26.2%
26.2%

australian

15.4%
12.3%

indian

25.4%
19.1%

Velocidad y latencia

p50 → p99

Velocidad de procesamiento

× tiempo real

0.1×

0.0×

Latencia p50

1.6s

3.1s

Latencia p90

3.7s

3.6s

Tiempo real / streaming

Promedios del benchmark en streaming

Ranking en tiempo real

de 17

#4

—

Puntuación en tiempo real

0–100

78.0

—

Tiempo hasta la primera palabra

986ms

—

Fiabilidad

Últimos 30 días

Disponibilidad

83.33%

—

Tasa de error

16.67%

—

Precios

facturado por segundo

Tarifa

por minuto

$0.0058

$0.0019

Granularidad de facturación

per 1s

per 1s

1 hora de audio

$0.35

$0.11

100 horas

$34.92

Capacidades

Soporte de características

Diarización de hablantes

Yes

No

Marcas de tiempo por palabra

Yes

Yes

Cambio de código

Yes

Cobertura y despliegue

Idiomas · formatos · regiones

Idiomas

33

12

Modo

Lotes y Tiempo real

Por lotes

Región

Estados Unidos

Estados Unidos

Formatos de audio

general

13.1%
8.1%

legal

3.8%
2.7%

medical

7.3%
2.8%

noisy

31.3%
36.3%

technical

4.9%
5.3%

uk

11.9%
6.0%

us

9.4%
5.7%

Latencia p99

3.7s

3.6s

Vaciado final

192ms

—

Factor de tiempo real

1.02×

—

Parpadeo

10.5%

—

Cadencia

0.8/s

—

$11.16

1.000 horas

$349.20

$111.60

No

Detección automática de idioma

Yes

Yes

En tiempo real / streaming

Yes

No

Vocabulario personalizado

Yes

No

mp3
wav
flac
m4a
ogg
webm
mp3
wav
flac
m4a
ogg
webm

Tamaño máx. de archivo

2 GB

100 MB

Duración máx.

Sin límite

Sin límite

Cumplimiento normativo

HIPAA
SOC2
GDPR

—

Preguntas frecuentes

¿Es Nova-2 o Whisper Large V3 más preciso?

Whisper Large V3 es más preciso, con una tasa de error de palabras del 14.4% frente al 16.5% de Nova-2, según nuestro benchmark estandarizado.

¿Cuál es más económico, Nova-2 o Whisper Large V3?

Whisper Large V3 es más económico a $0.0019/min frente a $0.0058/min de Nova-2.

¿Deberías elegir Nova-2 o Whisper Large V3?

Elige Nova-2 para velocidad and cobertura de idiomas; elige Whisper Large V3 para precisión and menor coste.