Modelo insignia de Deepgram — 53% menos WER vs competidores, soporte de cambio de código
47 idiomas · evaluado
Puntuación General
71.1
#24 de 28
Tasa de Error de Palabras
20.98%
Tasa de Error de Caracteres
11.48%
Tasa de Error de Coincidencia
20.03%
Información de Palabras Perdida
25.79%
Latencia Promedio
1.0s
Benchmarks Ejecutados
35
últimas 30 ejecuciones
Tasa de error de palabra
15.18%
↓ 31.1% · 30d
hace 4 ejecuciones
última
Latencia media
1.0s
↓ 21.8% · 30d
hace 4 ejecuciones
última
WER general · 28 modelos
Nova-3
grupo · 27 modelos
abajo a la izquierda es mejor
8 categorías
WER
menor es mejor
Técnico
2.8%
Legal
3.8%
Finanzas
9.5%
Médico
9.5%
Conversacional
12.2%
Ambiente Ruidoso
21.8%
General
23.4%
Cambio de Código
63.0%
p50 → p99 · 4 ejecuciones
Distribución de latencia
menor es mejor
1.3s
p50
1.8s
p90
1.8s
p95
1.8s
p99
5 acentos
Puntuación en Tiempo Real
76.6
TTFW (P50)
973 ms
Parpadeo
9.6%
Cadencia
0.8/s
RTF
1.01×
Tasa de Error de Palabras
18.17%
Tasa de Error de Caracteres
11.05%
Benchmarks Ejecutados
34
pago por segundo
Tarifa
$0.0077
/min
Facturación por segundo. Usa tu propia clave de proveedor y paga directamente al proveedor — se aplica una tarifa de enrutamiento del 5% (primeros 100 min/mes gratis).
Configurar BYOKEstimador de costo
1 hora
$0.46
10 horas
$4.61
100 horas
$46.08
1000 horas
$460.80
Facturado por segundo de audio procesado.
POST /api/v1/transcriptions
ID del modelo
deepgram/nova-3
Autentica cada solicitud con tu clave API secreta como token Bearer. Genera una clave desde tu panel.
Este modelo también admite streaming en tiempo real por WebSocket.
Inicio rápido
Sube tu audio, crea un trabajo con este modelo y luego consulta el trabajo o define un webhook_url para recibir el aviso al completarse.
Parámetros clave
file_path
string
obligatorio
Ruta de almacenamiento devuelta por el paso de subida.
model
string
obligatorio
El modelo con el que se ejecuta este trabajo.
language
string
Código de idioma ISO 639-1. Omítelo para la detección automática.
diarization
boolean
Etiqueta a los hablantes (A, B, …) en el resultado.
webhook_url
string
URL HTTPS que recibe el resultado al completarse el trabajo. Los eventos entregados están firmados (X-OT-Signature).
Respuesta
Un trabajo completado devuelve la transcripción en el Esquema Unificado de OpenTranscription (OTUS).
Webhooks — sin sondeo
Enviamos un evento firmado a tu webhook_url cuando un trabajo se completa o falla; verifica la cabecera X-OT-Signature (HMAC-SHA256, rechaza si tiene más de 300 s) y desduplicado por el id del evento, luego obtén la transcripción completa con GET /api/v1/transcriptions/{id}.
Límite por nivel — consulta los encabezados de respuesta X-RateLimit-*.
Referencia completa de la APIúltimos 30 días
Disponibilidad · 30d
100.00%
Tasa de error
0.00%
Latencia media
5.2s
Último incidente
Ninguno en 30d
del mismo grupo
Idiomas Soportados
Formatos Soportados
Características
Nova-3 es un modelo de transcripción de voz a texto de Deepgram. En nuestras pruebas estandarizadas alcanza una tasa de error de palabra de 30.75%, ocupando el puesto n.º 24 de 28 modelos evaluados. Admite 47 idiomas y cuesta 0,008 US$/min — de precio intermedio.
Su alternativa evaluada más cercana es Amazon Transcribe. Ideal para subtitulado en vivo y transcripción en streaming, conversaciones con varios interlocutores y cargas de trabajo multilingües.