ParseJet

動画 文字起こし — あらゆる動画をテキスト化

動画ファイルをアップロードして、その中で話されていることをすべてテキスト化できます。ブラウザがまず音声トラックを抽出するため、500MB のスクリーン録画や携帯動画でも数 MB でアップロードできます。その後 ParseJet が当社のサーバーで実行する音声認識で処理します。複数言語対応、句読点付き、タイムスタンプ付きで出力でき、無料で試用できます。API 経由でも開発者はワンコールで同じ結果が得られます。

ここにファイルをドロップするか、 参照

MP4,MOV,MKV,WEBM,AVI,WMV,M4V,FLV,3GPファイルを受け付けます

無料 — 1日3リクエスト、登録不要。 して月300クレジットを無料で。

仕組み

1

動画ファイルをアップロード

MP4、MOV、MKV、WebM、AVI、WMV、M4V をドロップしてください。ブラウザがその場で音声トラックを抽出するため、動画ファイル自体はアップロードされません。

2

音声認識で処理

言語は自動検出され、ParseJet のサーバーで音声が文字起こしされます。句読点と段落が自動で挿入されます。

3

テキストをコピー

ノートや字幕、要約用にテキストをコピーできます。API では JSON 形式でタイムスタンプ付きで取得できます。

主な機能

このvideo to textが際立つ理由。

あらゆる動画形式に対応

MP4、MOV、MKV、WebM、AVI、WMV、M4V、FLV、3GP に対応しており、スマートフォン動画、スクリーン録画、Zoom エクスポート、カメラファイルなど幅広い形式に対応しています。

大容量アップロードが不要

ブラウザで抽出された圧縮モノラル音声トラックだけが送信されます。動画の解像度がどうであれ、約 360 KB / 分のコンパクトなサイズです。

複数言語に自動対応

自動判定対応。英語、スペイン語、ポルトガル語、フランス語、ドイツ語、日本語、中国語、韓国語、アラビア語、ロシア語など多数言語に対応しています。

タイムスタンプ付きで提供

すべてのテキスト化結果にはタイムスタンプ付きセグメントが含まれます。字幕やチャプターマーカー作成の素材として活用できます。

プライバシーを重視した設計

音声認識は ParseJet が運用するサーバーでオープンソースモデルを使用して実行されます。処理完了後、音声は破棄されます。

API で大量処理に対応

/v1/parse/video に動画ファイルを POST すると JSON で文字起こしが返ります。Python と JavaScript の SDK が利用できます。

ユースケース

このツールが時間を節約する一般的なシナリオ。

講義とウェビナー

録画された授業やウェビナーを検索・引用可能なテキストに変換して記事や資料作成に活用できます。

会議の録画

Zoom、Teams、Meet のエクスポート動画を文字起こしして、テキストを Claude や ChatGPT に貼り付けて議事録や実行項目を生成できます。

字幕とキャプション

タイムスタンプ情報を使用して、SNS やアクセシビリティ用に動画にキャプションを追加できます。

コンテンツの二次利用

動画で実際に話されている内容からブログ記事、ニュースレター、SNS スレッドを作成できます。

APIで自動化

同じツールをプログラムで使用。HTTPのみで、あらゆる言語で動作します。

cURL
# Transcribe a video file (MP4, MOV, MKV, WebM, AVI ...)
curl -X POST https://api.parsejet.com/v1/parse/video \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" \
  -F "language=en"

# Response: text + metadata.segments [{start, end, text}], duration, language
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/video",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("lecture.mp4", "rb")},
    timeout=600,
)
data = resp.json()
print(data["text"])
print(data["metadata"]["duration"], "seconds,", data["metadata"]["language"])
JavaScript
const formData = new FormData();
formData.append("file", videoFile); // MP4, MOV, MKV, WebM, AVI ...

const res = await fetch("https://api.parsejet.com/v1/parse/video", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments);

自動化をお求めですか?

ParseJet APIは、単一のHTTPエンドポイントで同じ解析機能を提供します。ffmpeg、poppler、tesseractは不要。APIコール一つだけです。

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
APIドキュメントを読む

よくある質問

動画をテキストに文字起こしするには?

上の枠に動画をドロップしてください。ブラウザが音声トラックを抽出し、その小さいファイルをアップロードすると、文字起こし結果が下に表示されます。登録なしで 1 日 3 回まで無料で使用できます。

動画全体をアップロードする必要がありますか?

いいえ。ブラウザでその場で音声トラックが抽出され、それだけが送信されます。だいたい 360 KB / 分です。2GB の動画でも動作します。初回実行時はブラウザ内コンバータ(約 30 MB)をダウンロードします。

動画の最大長は?

1 回のリクエストで最大 5 分の音声に対応しています。より長い動画の場合は、ファイルをトリミング・分割してから送信するか、API を使用して分割送信してください。タイムスタンプがあるため、複数の結果を簡単に結合できます。

対応言語は?

自動判定で対応します。英語、スペイン語、ポルトガル語、フランス語、ドイツ語、イタリア語、オランダ語、ポーランド語、ロシア語、トルコ語、アラビア語、日本語、韓国語、中国語など数十言語に対応しています。短い動画では language=ja などを指定するとよいでしょう。

YouTube 動画を文字起こしできますか?

YouTube Transcript ツールをお使いください。字幕がある場合はそれを取得し、ない場合は音声を文字起こしします。このページは、デバイスに保存されている動画ファイル用です。

無料ですか?

はい。登録なしで 1 日 3 回まで無料です。1 回の動画 文字起こし は 5 クレジット(最大 5 分の音声)です。無料枠は毎月 300 クレジット。有料プランは月 19 ドルからです。

無料でテキスト抽出を始める

サインアップ不要。数秒で最初のファイルを解析。

料金を見る