ファイルを選ぶと処理を始めます。初回は約91MBの認識データを読み込みます。1ファイル100MB・30分まで。短く明瞭な録音に向いています。
文章の長さを確認するなら文字数をかぞえるもどうぞ。
録音を文字にする手順
ファイルを選ぶと読み込みと文字起こしが始まります。途中で中止でき、別のファイルに変更すると前の処理を止めます。結果を編集してコピーするか、TXTで保存できます。
対応する音声と長さ
WAV・MP3・M4A・AAC・WebM・OGG・FLACのうち、お使いのブラウザで再生できる形式に対応します。100MBまたは30分を超える録音は、短く分けてください。音声の区間ごとに進捗と途中結果が表示されます。
認識結果の確認
軽量なWhisper baseモデルを使います。固有名詞・数字・小さな声・重なった発言は誤認識することがあります。原音と照合してから利用してください。話者の分離や翻訳は行いません。長い録音の区切りでは語が欠けたり重複する場合があります。
通信と保存
音声と認識結果はサーバーへ送信しません。初回のみ当サイトから約91MBの認識用データを取得します。保存可能なブラウザではモデルをキャッシュします。ブラウザを閉じると入力音声と編集結果は失われるため、必要な結果はTXTで保存してください。