top of page
カテゴリ
タグ
アーカイブ


音声データをPythonの音声認識モデルを使用して文字起こし
こんにちは、あどりらです。 社内学習にてAIを学ぶきっかけがあり、何から学んでみるかと考えたときに、最初に目についたものが音声の文字起こしでした。 当時社内で会議における議事録作成の負担軽減を目的として、音声録音および変換ツールの導入を検討する意見が挙がっておりました。 そのような折、自作での構築が可能であれば非常に有用であると考え、「文字起こし」に関心を抱きました。 オープンソースとして公開されている複数のモデルを調査したところ、その中でも特に導入の障壁が低いと考えられた「Whisper」を採用し、構築を試みることにいたしました。 これはその時の備忘録です。 開発環境 開発言語:Python 開発エディタ:Visual Studio Code 仕様ライブラリ:whisper Pythonのインストール 公式HPからインストーラーをダウンロードしてください。 Releaseの最新バージョンのDownloadを選択します。 Windowsの64bit版をダウンロードします。 インストーラーをダブルクリックしてインストールを開始します。 「Add p

あどりら
6月9日
最新記事






bottom of page