Audio a texto

Subid una grabación y obtened el texto. Una entrevista, una clase, una llamada o una nota de voz: la transcripción usa un modelo que aguanta el ruido y los acentos.

Arrastra aquí o pega desde el portapapeles (Ctrl+V)

0 de 1 seleccionados

mp3, wav, m4a, ogg — hasta 20 MB. Arrastradlo aquí o pegadlo del portapapeles

Si transcribís a menudo

Konspekt: notas de reuniones que no salen de vuestro ordenador

Un bloc de notas inteligente para reuniones. Konspekt graba la conversación, la transcribe y la convierte en notas dentro de vuestra propia máquina. No se sube nada: ni el audio, ni la transcripción, ni las notas.

Descargar Konspekt

Gratis. Se instala en un minuto y luego funciona sin conexión.

El resumen: decisiones, responsables y temas abiertos
La transcripción: cada línea con su autor
Vuestras notas junto a la transcripción
Dictado: el texto aparece donde esté el cursor

El resumen: decisiones, responsables y temas abiertos

Detecta la conversación

Si hay voces en el ordenador y la grabación está apagada, Konspekt propone empezar. No se guarda nada hasta que aceptéis.

Graba ambos lados

Vuestro micrófono y el audio del sistema, así la otra persona también queda grabada.

Distingue a quien habla

Nombrad a alguien una vez y Konspekt reconocerá su voz en reuniones posteriores.

Escribe el resumen

Decisiones, quién hace qué y qué queda abierto, sacado de la conversación real.

Funciona en vuestro ordenador

Self-hosted de verdad: el audio, la transcripción y las notas quedan en una carpeta de vuestro disco. Nada va al servidor de nadie y la aplicación sigue funcionando sin conexión.

Gratis y sin cuenta

Sin registro, sin clave de API, sin suscripción. Se descarga, se instala en un minuto y ya está.

Código abierto

El código está en GitHub: leedlo, cambiadlo, compiladlo vosotros mismos. FSL-1.1-MIT solo prohíbe revenderlo como producto competidor.

Saber más

Código abierto con licencia FSL-1.1-MIT. Cada versión pasa a MIT a los dos años.

Qué es la transcripción

La transcripción convierte la palabra hablada en texto escrito. Lo dicho en una conversación, una clase o una entrevista pasa a ser un documento que podéis buscar, citar y editar.

Subid el archivo y el modelo reconoce la voz. Según la duración y la limpieza del sonido tarda de unos segundos a unos minutos. La precisión depende de la grabación original: el ruido y las voces superpuestas estorban tanto al modelo como a una persona.

Para quién

  • Periodismo: entrevistas y ruedas de prensa.
  • Educación: clases y seminarios en texto.
  • Derecho: vistas y declaraciones.
  • Medicina: dictados y consultas.
  • Empresa: reuniones, seminarios web y presentaciones.
  • Vídeo: subtítulos y versión en texto.