Whisper

来自 OpenAI · github.com ↗

音频、语音与音乐 开放(开放权重/源码) 可用性:全球 发布于 2022-09

OpenAI 的开源自动语音识别模型,用于转写与翻译。

speech-to-text open-weights transcription

分类
音频、语音与音乐
商业模式
开放(开放权重/源码)
可用性
全球
发布
2022-09
记录更新
2026-07-27
许可证
MIT
成立时间
2015
总部所在地
US
规范网址
https://globalaiproductindex.com/zh/products/whisper/

概述

Whisper 是 OpenAI 的开源自动语音识别模型,于 2022 年以 MIT 许可发布。它可转写并翻译数十种语言的语音,且可在本地运行,因而成为无数应用中转写功能的默认选择。也可通过 OpenAI API 使用托管版本。

主要功能

适用场景

定价

模型可在 MIT 许可下免费下载与自托管;托管的 OpenAI API 按音频分钟计费。

常见问题

Whisper 免费吗?

免费。Whisper 以 MIT 许可开源,可免费在本地运行;托管 API 按用量计费。

Whisper 支持哪些语言?

Whisper 可转写数十种语言的语音,并可将语音翻译为英语。

Whisper 由谁开发?

Whisper 由 OpenAI 开发并于 2022 年开源。

同类产品

查看Whisper的全部替代品 → · 查看全部音频、语音与音乐产品 →

来源

本记录最近复核于 2026-07-27。

机器可读记录:/api/products/whisper.json · 发现错误?提交纠错