ParseJet

WAV 文字起こしツール

WAVファイルをアップロードすると、話されている内容すべての正確な文字起こしが手に入ります。WAVはICレコーダー、DAW、電話システムが出力する形式です。ParseJetがAI音声認識で文字起こしします。登録なしで無料で試せます。

ここにファイルをドロップするか、 参照

WAV,MP3,M4A,OGG,FLACファイルを受け付けます

無料 — 1日3リクエスト、登録不要。 して月300クレジットを無料で。

仕組み

1

WAVファイルをアップロード

.wavの録音を上にドロップします。25 MBまでのファイルに対応。MP3、M4A、OGG、FLACも使えます。

2

AIが文字起こし

発話をAI音声認識で文字起こしします。インタビュー、口述、電話録音のいずれも処理できます。

3

文字起こしをコピー

メモ、文書、字幕用にテキストをコピーできます。録音をまとめて文字起こしする場合はAPIを呼び出してください。

主な機能

このwav to textが際立つ理由。

非圧縮音声ならではの精度

WAVはロスレス形式です。圧縮によるノイズが混ざらないため、音声認識の品質は文字起こしとして望みうる最高水準になります。

高精度なAI音声認識

最新の文字起こしモデルが、早口、訛り、理想的とはいえない録音環境もしっかり処理します。

多言語対応

数十の言語の発話を文字起こしできます。APIで言語ヒントを渡すと最良の結果が得られます。

単語単位のタイムスタンプ

字幕用にタイミング情報が必要ですか?APIのwith_timestampsオプションで、単語単位のタイムスタンプを返せます。

読みやすい出力

文字起こしは句読点付きのきれいな文章として返ってきます。単語がだらだら続くだけの壁のようなテキストにはなりません。

主要な音声形式もすべて

同じエンドポイントでMP3、M4A、OGG、FLAC、WebMも処理できます。1つの連携であらゆる録音ソースをカバーできます。

ユースケース

このツールが時間を節約する一般的なシナリオ。

ICレコーダーの録音

ICレコーダーやフィールド録音の機材はWAVで保存します。何時間分もの録音を、検索できるテキストに変えられます。

通話・会議の録音

電話システムや会議ツールはWAVを書き出します。通話を文字起こしして、議事録、品質管理、フォローアップに活用できます。

スタジオ・ポッドキャストのマスター音源

圧縮される前のロスレスなマスターを文字起こしできます。ショーノートや字幕のための最もクリーンなソースです。

AIワークフロー

ClaudeやChatGPTは音声ファイルを聴けません。先に文字起こしをして、そのテキストを渡せば要約や分析ができます。

APIで自動化

同じツールをプログラムで使用。HTTPのみで、あらゆる言語で動作します。

cURL
# Transcribe a WAV file
curl -X POST https://api.parsejet.com/v1/parse/audio \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" \
  -F "language=en"

# With word-level timestamps:
#   -F "with_timestamps=true"
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/audio",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("recording.wav", "rb")},
    data={"language": "en"},
    timeout=120,
)
print(resp.json()["text"])  # the transcript
JavaScript
const formData = new FormData();
formData.append("file", wavFile); // WAV, MP3, M4A, OGG, FLAC
formData.append("language", "en");

const res = await fetch("https://api.parsejet.com/v1/parse/audio", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const { text } = await res.json();
console.log(text); // the transcript

自動化をお求めですか?

ParseJet APIは、単一のHTTPエンドポイントで同じ解析機能を提供します。ffmpeg、poppler、tesseractは不要。APIコール一つだけです。

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
APIドキュメントを読む

よくある質問

WAVファイルを文字起こしするにはどうすればいいですか?

上のエリアに.wavファイルをアップロードするだけです。ParseJetがAI音声認識で発話を文字起こしし、テキストを表示します。自動化する場合は /v1/parse/audio にPOSTしてください。

ファイルサイズの上限はどれくらいですか?

1ファイルあたり25 MBまでです。WAVは非圧縮のため、CD品質のステレオならおよそ2分に相当します。長い録音は先にMP3やFLACへ変換するか、ファイルを分割してください。

WAVの文字起こしの精度はどれくらいですか?

クリアに録音された発話は非常に高い精度で文字起こしされます。ロスレスなWAV入力は認識エンジンに最良の信号を与えます。強い背景ノイズや発話の重なりがあると精度は下がります。

字幕用のタイムスタンプは取得できますか?

はい。APIにwith_timestamps=trueを渡すと、レスポンスに単語単位のタイミング情報が含まれ、SRTやVTTの字幕に変換できます。

どの言語に対応していますか?

日本語、英語、中国語、スペイン語、フランス語、ドイツ語など数十の言語に対応しています。短いクリップでは、APIで言語ヒントを渡すと最良の結果が得られます。

WAVの文字起こしは無料でできますか?

はい。登録なしで1日3回まで無料で文字起こしできます。音声ファイル1件は1クレジットで、無料アカウントには月300クレジットが含まれます。有料プランは月額$19からです。

無料でテキスト抽出を始める

サインアップ不要。数秒で最初のファイルを解析。

料金を見る