ParseJet

Transcribir video a texto — Convierte cualquier video

Sube un video y obtén todo lo que se dice en él como texto. Tu navegador extrae primero la pista de audio, así que una grabación de pantalla de 500 MB o un video de teléfono se sube como un par de megabytes; ParseJet luego lo transcribe con reconocimiento de voz que se ejecuta en nuestros propios servidores. Docenas de idiomas, puntuación, segmentos cronometrados — es gratis y el mismo resultado es una llamada de API para desarrolladores.

Suelta un archivo aquí o explorar

Acepta archivos MP4,MOV,MKV,WEBM,AVI,WMV,M4V,FLV,3GP

Gratis — 3 solicitudes/día, sin registro. para 300 créditos/mes gratis.

Cómo funciona

1

Sube tu video

Arrastra un MP4, MOV, MKV, WebM, AVI, WMV o M4V. El audio se extrae en tu navegador, así que el video en sí nunca tiene que ser subido.

2

Reconocimiento de voz

El idioma se detecta y la voz se transcribe en los servidores de ParseJet, con puntuación y saltos de párrafo en las pausas.

3

Copia la transcripción

Copia el texto para notas, subtítulos o un resumen, u obtenlo como JSON con timestamps a través de la API.

Características principales

Lo que hace que este video to text destaque.

Todos los formatos de video comunes

MP4, MOV, MKV, WebM, AVI, WMV, M4V, FLV y 3GP — videos de teléfono, grabaciones de pantalla, exportaciones de Zoom, archivos de cámara.

Sin cargas enormes

Solo sale de tu máquina una pista de audio mono compacta: alrededor de 360 KB por minuto, sea cual sea la resolución del video.

Docenas de idiomas

Detectados automáticamente; inglés, español, portugués, francés, alemán, japonés, chino, coreano, árabe, ruso y más.

Timestamps incluidos

Los segmentos cronometrados vuelven con cada transcripción — el material crudo para subtítulos y marcadores de capítulos.

Privado por diseño

El reconocimiento se ejecuta en servidores que opera ParseJet con modelos de código abierto; el audio se descarta una vez que se devuelve la transcripción.

API para escala

Envía un archivo de video a /v1/parse/video y obtén la transcripción como JSON. SDKs para Python y JavaScript disponibles.

Casos de uso

Escenarios comunes donde esta herramienta te ahorra tiempo.

Conferencias y webinars

Convierte una clase registrada o un webinar en notas que puedas buscar, citar y resumir.

Grabaciones de reuniones

Los exportes de Zoom, Teams y Meet se convierten en actas y elementos de acción — pega la transcripción en tu asistente de IA.

Subtítulos y leyendas

Usa los segmentos cronometrados para subtitular un video para redes sociales o accesibilidad.

Reutilización de contenido

Redacta la publicación del blog, el boletín o el hilo desde lo que realmente se dijo en el video.

Automatiza con la API

Usa la misma herramienta de forma programática. Funciona con cualquier lenguaje — solo HTTP.

cURL
# Transcribe a video file (MP4, MOV, MKV, WebM, AVI ...)
curl -X POST https://api.parsejet.com/v1/parse/video \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -F "[email protected]" \
  -F "language=en"

# Response: text + metadata.segments [{start, end, text}], duration, language
Python
import httpx

resp = httpx.post(
    "https://api.parsejet.com/v1/parse/video",
    headers={"Authorization": "Bearer YOUR_API_KEY"},
    files={"file": open("lecture.mp4", "rb")},
    timeout=600,
)
data = resp.json()
print(data["text"])
print(data["metadata"]["duration"], "seconds,", data["metadata"]["language"])
JavaScript
const formData = new FormData();
formData.append("file", videoFile); // MP4, MOV, MKV, WebM, AVI ...

const res = await fetch("https://api.parsejet.com/v1/parse/video", {
  method: "POST",
  headers: { Authorization: "Bearer YOUR_API_KEY" },
  body: formData,
});
const { text, metadata } = await res.json();
console.log(text, metadata.segments);

¿Quieres automatizar esto?

ParseJet API te ofrece el mismo poder de análisis a través de un único endpoint HTTP. Sin ffmpeg, sin poppler, sin tesseract — solo una llamada a la API.

curl -X POST https://api.parsejet.com/v1/parse/auto/url \ -H "Content-Type: application/json" \ -d '{"url":"https://example.com"}'
Leer Documentación de la API

Preguntas frecuentes

¿Cómo transcribo un video a texto?

Arrastra el video arriba. Tu navegador extrae la pista de audio, sube ese pequeño archivo, y la transcripción aparece debajo de la caja — cópiala desde ahí. Tres transcripciones al día son gratis sin una cuenta.

¿Tengo que subir todo el video?

No. El audio se extrae en tu navegador y solo eso se envía — aproximadamente 360 KB por minuto. Una grabación de 2 GB sigue funcionando; la primera ejecución descarga el convertidor en el navegador (aproximadamente 30 MB) una vez.

¿Cuánto tiempo puede durar el video?

Hasta 5 minutos de audio por solicitud. Para videos más largos, recorta o divide el archivo, o envía las partes a través de la API — los timestamps hacen que sea fácil unir las transcripciones de nuevo.

¿Qué idiomas son compatibles?

Docenas, detectadas automáticamente: inglés, español, portugués, francés, alemán, italiano, holandés, polaco, ruso, turco, árabe, japonés, coreano, chino y más. Agrega language=xx para clips cortos.

¿Puedo transcribir un video de YouTube?

Usa la herramienta YouTube Transcript: obtiene los subtítulos cuando existen y de lo contrario transcribe el audio. Esta página es para archivos de video en tu dispositivo.

¿Es gratis?

Sí. Tres transcripciones gratis al día sin registro. Una transcripción de video cuesta 5 créditos (hasta 5 minutos de audio); la cuenta gratis incluye 300 créditos al mes. Los planes pagos comienzan en $19/mes.

Comienza a extraer texto gratis

No requiere registro. Analiza tu primer archivo en segundos.

Ver Precios