Whisper
por OpenAI · github.com ↗
Modelo de reconhecimento automático de fala de código aberto da OpenAI para transcrição e tradução.
speech-to-text open-weights transcription
- Categoria
- Áudio, voz e música
- Modelo de negócio
- Aberto (pesos/código aberto)
- Disponibilidade
- Global
- Lançado
- 2022-09
- Registro atualizado
- 2026-07-27
- Licença
- MIT
- Fundada
- 2015
- Sede
- US
Visão geral
O Whisper é o modelo de reconhecimento automático de fala de código aberto da OpenAI, lançado em 2022 sob a licença MIT. Ele transcreve e traduz fala em dezenas de idiomas e pode rodar localmente, o que o tornou a escolha padrão para transcrição em inúmeras aplicações. O uso hospedado também está disponível pela API da OpenAI.
Principais recursos
- ASR de código aberto sob licença MIT
- Transcrição em dezenas de idiomas
- Tradução de fala para o inglês
- Roda localmente ou pela API da OpenAI
Casos de uso
- Transcrever reuniões, podcasts e entrevistas
- Integrar recursos de voz em aplicações
- Transcrição offline quando a privacidade importa
Preços
O modelo é gratuito para baixar e auto-hospedar sob MIT; a API hospedada da OpenAI é cobrada por minuto de áudio.
Perguntas frequentes
O Whisper é gratuito?
Sim. O Whisper é open source sob licença MIT e pode rodar localmente sem custo; a API hospedada é cobrada por uso.
Quais idiomas o Whisper suporta?
O Whisper transcreve fala em dezenas de idiomas e pode traduzir fala para o inglês.
Quem desenvolve o Whisper?
O Whisper foi desenvolvido e aberto pela OpenAI em 2022.
Produtos similares
- AIVA — Assistente de composição musical com IA que gera faixas originais em muitos estilos para projetos de mídia.
- AssemblyAI — API de fala para texto que oferece modelos de transcrição e inteligência de áudio para desenvolvedores.
- Cartesia — Plataforma de geração de voz em tempo real baseada em modelos de espaço de estados para síntese de fala de baixa latência.
- Deepgram — API de reconhecimento de fala e IA de voz para transcrição em tempo real e compreensão de áudio.
- Descript — Editor de áudio e vídeo com IA que permite editar gravações editando sua transcrição.
- ElevenLabs — Plataforma de voz com IA que oferece conversão de texto em fala, clonagem de voz e dublagem.
Todas as alternativas a Whisper → · Todos os produtos de Áudio, voz e música →
Fontes
Este registro foi revisado pela última vez em 2026-07-27.
Registro legível por máquina: /api/products/whisper.json · Encontrou um erro? Sugerir uma correção