Modelos speech-to-text y transcripción

Speech-to-text es el primer paso de muchos pipelines de voz: meetings, call centers, subtítulos. Hoy el catálogo público destaca Whisper-1; la misma key de Geek Hub sirve para STT y para el LLM que resume después.

1 modelosActualizado 2026-08-27

Modelos en esta colección

ModeloTipoContextoPrecio
OpenAI Whisper-1OpenAISTT$0.0065 / min

Por qué estos modelos

Whisper-1 es el workhorse de transcripción OpenAI-compatible: robusto en varios idiomas y fácil de encadenar con un modelo de chat de otra colección.

Úsalos con Geek Hub

Una base URL compatible con OpenAI y una API key. Cambia cualquier model id de esta lista sin reescribir tu cliente.

Consigue tu API key

Preguntas frecuentes

¿Solo hay un modelo STT?
En el catálogo curado de esta página sí (Whisper-1). El gateway puede ampliar proveedores; esta colección se actualiza cuando haya más ids públicos.
¿Cómo se cobra?
Por minuto de audio. Ver precio en la tabla.
¿Pipeline tipico?
Audio → Whisper → chat (Flash/mini) para resumen o CRM. Misma API key.

Más colecciones