Benchmark de transcripción en español
¿Por qué AudioMap usa AssemblyAI y no Whisper? Porque cada punto porcentual de WER se nota en el resultado final. Aquí los datos públicos por motor y variante regional.
WER (Word Error Rate): porcentaje de palabras incorrectas sobre el total. Más bajo = mejor. 0% sería perfecto.
Las cifras de la tabla son de AssemblyAI Universal-2, la generación anterior. En producción usamos Universal-3.5 Pro, de la que AssemblyAI no publica un WER comparable por variante regional.
AssemblyAI gana en todas las variantes
Universal-2 (generación anterior) mantiene WER <11% en las 5 variantes hispanas testadas. Whisper-large-v3 oscila entre 14.7% y 19.1%. Diferencia de 7-10 puntos en zonas con yeísmo o velocidad alta.
Whisper es razonable solo en español neutro
Whisper rinde aceptablemente en es-ES estándar pero pierde calidad en variantes regionales. TurboScribe, Fireflies y muchas alternativas low-cost lo usan.
Pendiente: benchmark propio AudioMap
Q3 2026 publicaremos un benchmark con audios curados por nosotros (10h por variante regional, dominio profesional, evaluación humana).
300 minutos al mes incluidos. Sin tarjeta.