OpenAPI オープンソースの堅牢な音声認識モデル。大規模な弱監督による学習
OpenAIのWhisperをベースにしたオープンソースのデスクトップソフトウェアで、音声を認識して字幕を生成します
自動音声認識、単語レベルのタイムスタンプ付き(話者分離対応)
OpenAIのWhisperモデルのC/C++移植版
オープンソース、OpenAIベースのWhisper、Windows用デスクトップアプリ。GPU処理を使用するため、GPU性能が良ければCPUより高速です。