Whisper

de OpenAI · github.com ↗

Audio, voz y música Abierto (pesos/código abierto) Disponibilidad: Global Lanzado en 2022-09

Modelo de reconocimiento automático de voz de código abierto de OpenAI para transcripción y traducción.

speech-to-text open-weights transcription

Categoría
Audio, voz y música
Modelo de negocio
Abierto (pesos/código abierto)
Disponibilidad
Global
Lanzamiento
2022-09
Registro actualizado
2026-07-27
Licencia
MIT
Fundación
2015
Sede
US
URL canónica
https://globalaiproductindex.com/es/products/whisper/

Resumen

Whisper es el modelo de reconocimiento automático de voz de código abierto de OpenAI, lanzado en 2022 bajo licencia MIT. Transcribe y traduce voz en decenas de idiomas y puede ejecutarse localmente, lo que lo ha convertido en la opción predeterminada para transcripción en innumerables aplicaciones. El uso alojado también está disponible mediante la API de OpenAI.

Funciones principales

Casos de uso

Precios

El modelo es gratuito para descargar y autoalojar bajo MIT; la API alojada de OpenAI se cobra por minuto de audio.

Preguntas frecuentes

¿Whisper es gratis?

Sí. Whisper es de código abierto bajo licencia MIT y puede ejecutarse localmente sin costo; la API alojada se cobra por uso.

¿Qué idiomas admite Whisper?

Whisper transcribe voz en decenas de idiomas y puede traducir la voz al inglés.

¿Quién desarrolla Whisper?

Whisper fue desarrollado y publicado como código abierto por OpenAI en 2022.

Productos similares

Todas las alternativas a Whisper → · Todos los productos de Audio, voz y música →

Fuentes

Este registro se revisó por última vez el 2026-07-27.

Registro legible por máquina: /api/products/whisper.json · ¿Detectaste un error? Sugerir una corrección