Whisper
von OpenAI · github.com ↗
OpenAIs quelloffenes Modell zur automatischen Spracherkennung für Transkription und Übersetzung.
speech-to-text open-weights transcription
- Kategorie
- Audio, Sprache & Musik
- Geschäftsmodell
- Offen (offene Gewichte/Quellcode)
- Verfügbarkeit
- Weltweit
- Veröffentlicht
- 2022-09
- Eintrag aktualisiert
- 2026-07-27
- Lizenz
- MIT
- Gegründet
- 2015
- Hauptsitz
- US
- Kanonische URL
- https://globalaiproductindex.com/de/products/whisper/
Überblick
Whisper ist OpenAIs quelloffenes Modell zur automatischen Spracherkennung, 2022 unter der MIT-Lizenz veröffentlicht. Es transkribiert und übersetzt Sprache in Dutzenden von Sprachen und kann lokal laufen, was es zur Standardwahl für Transkription in unzähligen Anwendungen gemacht hat. Gehostete Nutzung ist auch über die OpenAI-API verfügbar.
Wichtige Funktionen
- Quelloffene ASR unter MIT-Lizenz
- Transkription in Dutzenden Sprachen
- Sprach-zu-Englisch-Übersetzung
- Läuft lokal oder über die OpenAI-API
Anwendungsfälle
- Meetings, Podcasts und Interviews transkribieren
- Sprachfunktionen in Anwendungen integrieren
- Offline-Transkription, wenn Datenschutz zählt
Preise
Das Modell ist unter MIT kostenlos herunterladbar und selbst hostbar; die gehostete OpenAI-API wird pro Audiominute berechnet.
Häufig gestellte Fragen
Ist Whisper kostenlos?
Ja. Whisper ist Open Source unter MIT-Lizenz und läuft kostenlos lokal; die gehostete API wird nach Nutzung abgerechnet.
Welche Sprachen unterstützt Whisper?
Whisper transkribiert Sprache in Dutzenden Sprachen und kann Sprache ins Englische übersetzen.
Wer entwickelt Whisper?
Whisper wurde von OpenAI entwickelt und 2022 als Open Source veröffentlicht.
Ähnliche Produkte
- AIVA — KI-Kompositionsassistent, der Originaltracks in vielen Stilen für Medienprojekte erzeugt.
- AssemblyAI — Speech-to-Text-API mit Transkriptions- und Audio-Intelligence-Modellen für Entwickler.
- Cartesia — Plattform zur Echtzeit-Stimmerzeugung auf Basis von State-Space-Modellen für latenzarme Sprachsynthese.
- Deepgram — API für Spracherkennung und Voice-KI zur Echtzeit-Transkription und zum Audio-Verständnis.
- Descript — KI-gestützter Audio- und Videoeditor, mit dem du Aufnahmen bearbeitest, indem du ihr Transkript bearbeitest.
- ElevenLabs — KI-Sprachplattform mit Text-to-Speech, Stimmklonen und Synchronisation.
Alle Whisper-Alternativen → · Alle Produkte in Audio, Sprache & Musik →
Quellen
Dieser Eintrag wurde zuletzt am 2026-07-27 geprüft.
Maschinenlesbarer Eintrag: /api/products/whisper.json · Fehler entdeckt? Korrektur vorschlagen