Cada palabra de cada vídeo.

Suelta un archivo o pega un enlace, elige con cuánto cuidado queremos escuchar, y recibirás una transcripción con marcas de tiempo en una fracción de la duración.

¿Con cuánto cuidado queremos escuchar?

Tres transcripciones gratis. Sin tarjeta.

Pega un enlace de

Tres motores

Elige el equilibrio que de verdad quieres.

La velocidad y la precisión tiran en direcciones opuestas, y cuál importa depende de la grabación. Por eso la eliges tú en cada trabajo, y no nosotros una vez para todos. Estas cifras son mediciones en nuestra propia tarjeta, no estimaciones.

En una grabación empeorada a propósito — ancho de banda telefónico, con siseo encima — Ferrari cometió casi el triple de errores de palabra que Volvo, y Mercedes alrededor de un cuarto más. En una grabación limpia, Mercedes y Volvo devolvieron las mismas palabras.

Ferrari

3min por hora de audio

Fuerte en
Vuelve en minutos, no en decenas de minutos.
Cuesta
El doble de errores de palabra que Mercedes, sobre todo nombres y números.

Una décima parte del tamaño, se queda con la primera lectura que oye en lugar de sopesar varias, y empieza cada línea de cero en vez de arrastrar la frase anterior. Con voz limpia apenas lo notarás. Con una grabación ruidosa sí.

Prueba uno en Ferrari →

Mercedes

por defecto

7min por hora de audio

Fuerte en
El mejor equilibrio de los tres en casi cualquier grabación.
Cuesta
Un cuarto más de errores que Volvo cuando el audio es malo.

El oyente de tamaño completo con un escritor acortado, que sopesa cinco lecturas de cada línea antes de elegir una. Es lo que hay detrás de este sitio, y lo que casi todo el mundo debería usar.

Prueba uno en Mercedes →

Volvo

10min por hora de audio

Fuerte en
Menos errores con ruido, voces solapadas y acentos marcados.
Cuesta
Un tercio más de tiempo, y no mejor que Mercedes con audio limpio.

El mismo modelo que Mercedes, trabajando el doble: diez lecturas rivales de cada línea en vez de cinco, cada una llevada más lejos antes de elegir. Con una grabación limpia devolverá las mismas palabras. Se gana su tiempo en las difíciles.

Prueba uno en Volvo →

Todos los modos cuestan lo mismo. Tu plan compra horas, no calidad, así que una transcripción gratuita en Volvo es el mismo Volvo que recibe quien paga.

Lo que recibes

Una transcripción con la que se puede trabajar.

Marcas de tiempo hasta la palabra

Cada línea lleva un inicio y un final, y cada palabra dentro de ella también.

  • 00:00:07This program is brought to you by Stanford University.
  • 00:00:20I am honored to be with you today for your commencement
  • 00:00:27from one of the finest universities in the world.
  • 00:00:35Truth be told, I never graduated from college.

Subtítulos o texto plano

Exporta la misma transcripción de tres formas, sin reformatear nada.

SRTVTTTXT

99 idiomas, detectados solos

Pega algo en sueco, turco o portugués sin decirnos cuál es.

Puntuación que se lee como texto escrito

Frases, comas y signos de interrogación, para que el texto sirva tal como llega.

Archivos de hasta seis horas

Clases, pódcasts y reuniones grabadas enteras, hasta tres gigabytes. Los archivos largos se envían y se transcriben por partes, así que la cola puede decirte en qué parte va y una conexión caída solo cuesta la parte que iba en camino.

El motor funciona en nuestra propia máquina.

Tu audio se transcribe en equipos que son nuestros y que gestionamos nosotros. No se reenvía a ningún proveedor de IA externo y no se guarda para entrenar nada. El archivo que subes se borra a los siete días, salvo que nos pidas conservarlo. La transcripción se queda hasta que tú la borres.

Precios

Más barato que la tarifa habitual, a propósito.

Max

79 kral mes

Sin límite mensual. Transcribe todas las horas que quieras, un archivo tras otro, por los mismos 79 kr.

Light

39 kral mes

Diez horas de audio al mes. Suficiente para un pódcast semanal o un curso. Las horas no usadas no se acumulan.

Gratis

Tres transcripciones

Calidad completa, exportaciones completas, sin tarjeta. Después eliges plan o lo dejas.

Skribia — audio y vídeo a texto, con marcas de tiempo