Herramientas digitales: transcripción de audio
Nº de entradas: 15Detalles Cerrar β
Precio: gratuita
Etiquetas: grabación de audio transcripción de audio pódcast subtítulos
Descripción: Audacity es un editor y grabador de audio multipista desarrollado por Muse Group junto con una comunidad de colaboradores, y distribuido como software libre bajo licencia GNU GPL versión 3. Graba desde micrófono o desde la propia tarjeta de sonido e importa archivos WAV, AIFF, MP3, FLAC y Ogg, entre otros. Exporta en esos mismos formatos y, desde la versión 3.7.8, también capítulos en JSON según la especificación Podcast 2.0.Entre los efectos incorporados figuran Noise Reduction, que atenúa el...
Detalles Cerrar β
Plataforma: web Android iOS Windows Mac
Precio: modelo mixto
Etiquetas: edición de vídeos subtítulos texto a voz transcripción de audio
Descripción: CapCut es un editor de vídeo de ByteDance, la empresa propietaria de TikTok. Admite vídeo, audio, imágenes y texto, y devuelve vídeo montado, pistas de audio, imágenes y archivos de subtítulos.Auto captions, llamado también Recognise Subtitles, reconoce la voz del vídeo y genera los subtítulos sincronizados, que Caption templates puede formatear con estilos predefinidos. Text to speech convierte un texto en locución con voces sintéticas, y Custom voices genera una voz a partir de una muestra...
Detalles Cerrar β
Plataforma: web Android iOS Windows Mac extensión navegador
Precio: modelo mixto
Etiquetas: generación de textos creación de imágenes texto a voz transcripción de audio
Descripción: ChatGPT es el asistente conversacional de OpenAI. Admite texto, voz, imágenes y archivos —PDF, documentos, hojas de cálculo, código— y produce texto, imágenes, gráficos, archivos, voz y documentos editables.Entre sus funciones con nombre propio están los GPTs, asistentes configurados con instrucciones y archivos de conocimiento propios que se publican en una tienda; Canvas, un modo de edición en paralelo donde el texto o el código se tratan como un documento vivo; los Proyectos, espacios...
Detalles Cerrar β
Precio: modelo mixto
Etiquetas: texto a voz transcripción de audio clonación de voz generación de audio
Descripción: ElevenLabs es una plataforma de audio con IA que cubre síntesis de voz, clonación, transcripción, doblaje y generación musical. Admite texto, audio, vídeo e imagen, y devuelve voz sintética, efectos sonoros, música, transcripciones con marcas temporales y vídeo doblado.Entre sus funciones con nombre propio están Text to Speech, de texto a voz; Scribe, el modelo de transcripción, que cubre noventa y nueve idiomas; Voice Changer, que cambia la voz de una grabación conservando la interpretación;...
Detalles Cerrar β
Precio: modelo mixto
Etiquetas: transcripción de audio productividad
Descripción: Fathom es un asistente de reuniones con IA: se incorpora a las videollamadas, las graba, las transcribe y genera resúmenes y listas de tareas automáticamente. Admite el audio y el vídeo de reuniones en línea, con captura mediante un asistente visible en la sala o, en Mac, sin él; devuelve la grabación, la transcripción, resúmenes, tareas, fragmentos recortados y listas de reproducción.Entre sus funciones están Ask Fathom, una interfaz de chat para interrogar el contenido de las reuniones; la...
Detalles Cerrar β
Plataforma: web
Precio: modelo mixto
Etiquetas: creación de vídeos edición de vídeos subtítulos grabación de pantalla
Descripción: Google Vids es la aplicación de creación y montaje de vídeo de Google Workspace. Admite grabación de pantalla y de cámara, archivos propios, presentaciones de Google Slides e indicaciones de texto, y produce vídeos de hasta treinta minutos con subtítulos y exportación directa a YouTube.Help me create arma un primer montaje a partir de una indicación escrita y Slides to Vids convierte una presentación en vídeo. Transcript trim recorta el vídeo editando el texto de la transcripción, Styled...
Detalles Cerrar β
Precio: modelo mixto
Etiquetas: edición de vídeos creación de vídeos subtítulos texto a voz
Descripción: KineMaster es una aplicación de edición de vídeo para móviles y tabletas de KineMaster Corporation, empresa de software multimedia con sede en Seúl que la lanzó en 2013. Admite vídeo, imágenes y audio del dispositivo, además de texto para rótulos y locuciones, y exporta en MP4 hasta 4K a 60 fotogramas por segundo y en GIF, con relaciones de aspecto que van de 16:9 a 9:16 o 1:1.La edición se organiza en una línea de tiempo Multi-Layer con capas ilimitadas y animación por Keyframe, e incluye...
Detalles Cerrar β
Plataforma: web Android iOS extensión navegador
Precio: de pago
Etiquetas: transcripción de audio resumen de textos productividad
Descripción: Leexi graba y transcribe reuniones, tanto videollamadas como encuentros presenciales. Se integra con Zoom, Microsoft Teams y Google Meet, y tiene aplicación móvil para grabar reuniones en persona. A partir de la grabación genera un resumen estructurado y extrae las tareas pendientes, asignándolas a los participantes. Incorpora un asistente al que se le pueden hacer preguntas sobre el contenido de lo grabado, permite definir plantillas de resumen propias y compartir los resúmenes por enlace...
Detalles Cerrar β
Plataforma: web Android iOS Windows Mac extensión navegador
Precio: modelo mixto
Etiquetas: toma de notas productividad colaboración gestión del aula
Descripción: OneNote es el cuaderno digital de Microsoft. Se organiza en blocs divididos en secciones y páginas de lienzo libre, donde se colocan texto, imágenes, archivos adjuntos, grabaciones de audio y vídeo, recortes de páginas web y escritura a mano; el contenido se sincroniza entre dispositivos y se exporta a PDF.El Bloc de notas de clase reparte el bloc en tres áreas: una Biblioteca de contenido de solo lectura, un Espacio de colaboración común y un cuaderno privado por estudiante que solo ve el...
Detalles Cerrar β
Plataforma: web extensión navegador iOS
Precio: modelo mixto
Etiquetas: grabación de audio texto a voz transcripción de audio traducción
Descripción: Mote es una extensión de navegador y una aplicación para iOS desarrolladas por Mote Technologies. Admite voz, texto de páginas web, documentos y PDF, incluidos los digitalizados, y devuelve notas de voz con transcripción automática, audio de lectura, traducciones y listas de vocabulario.El moteSidebar reúne las funciones en un panel lateral. Read Aloud lee en voz alta el texto de una página, también el contenido en imágenes, y resalta la frase que suena en cada momento. La grabación de notas de...
Detalles Cerrar β
Plataforma: web
Precio: de pago
Etiquetas: chatbot generación de textos creación de imágenes generación de audio
Descripción: OpenAI Platform es el entorno para desarrolladores de OpenAI, separado de ChatGPT: da acceso por API a los modelos de la empresa y a las herramientas para construir aplicaciones con ellos. Admite texto, imágenes, audio, archivos y esquemas de datos, y devuelve texto, JSON estructurado, imágenes, audio y vídeo.La Responses API es la vía principal de llamada a los modelos, con herramientas integradas de búsqueda web, búsqueda en archivos, intérprete de código y uso del ordenador. La Realtime API...
Detalles Cerrar β
Plataforma: web
Precio: modelo mixto
Etiquetas: grabación de audio transcripción de audio subtítulos pódcast
Descripción: StudioEditor es un grabador y editor de audio que funciona íntegramente en el navegador, orientado a la producción de pódcast. Pese al nombre, no es un editor de vídeo ni de diseño. Permite grabar desde el navegador incorporando hasta tres invitados remotos en la misma sesión, y ofrece una línea de tiempo multipista donde se importa, corta y ordena el audio arrastrando bloques. Genera la transcripción y permite editar por texto: al borrar una palabra o una frase del transcrito desaparece el...
Detalles Cerrar β
Plataforma: web
Precio: modelo mixto
Etiquetas: transcripción de audio subtítulos traducción
Descripción: TurboScribe es un servicio de transcripción automática de audio y vídeo operado por Leif Erikson Ventures, LLC. Funciona en el navegador: se suben archivos —MP3, WAV, M4A, FLAC, OGG, MP4, MOV, MKV, WEBM, AVI y otros formatos— y devuelve el texto transcrito, que se descarga como PDF, DOCX, TXT, CSV o como subtítulos SRT y VTT.La transcripción se lanza en tres modos, Cheetah, Dolphin y Whale, que van del más rápido al más preciso. El sistema distingue e identifica a los hablantes dentro del texto...
Detalles Cerrar β
Plataforma: web Windows Mac Linux
Precio: gratuita
Etiquetas: transcripción de audio subtítulos
Descripción: Whisper es un modelo abierto de reconocimiento automático del habla publicado por OpenAI con licencia MIT, código y pesos incluidos. Admite archivos de audio y de vídeo en prácticamente cualquier formato y devuelve la transcripción en texto plano, en JSON y en formatos de subtítulo con marcas de tiempo, además de traducción al inglés e identificación automática del idioma.Se distribuye en varios tamaños —tiny, base, small, medium, large y turbo—, que van de los 39 a los 1.550 millones de...
Detalles Cerrar β
Plataforma: web Windows Mac iOS Android extensión navegador
Precio: modelo mixto
Etiquetas: videoconferencia colaboración gestión del aula interacción en el aula
Descripción: Zoom Workplace es la plataforma de reuniones en línea de Zoom Communications, Inc. Las sesiones se crean con un identificador o un enlace y admiten vídeo, audio, chat escrito y compartición de pantalla o de aplicaciones concretas. La grabación se guarda en el equipo local o en la nube del servicio, y las transcripciones y los resúmenes se descargan como archivos de texto.Incorpora Breakout Rooms para repartir a los asistentes en subgrupos, Whiteboard como pizarra compartida persistente,...
Clasificación
- creación de materiales (72)
- vocabulario (37)
- creación de actividades (34)
- materiales interactivos (33)
- colaboración (28)
- creación de imágenes (27)
- creación de vídeos (27)
- evaluación (27)
- juegos (27)
- creación de cuestionarios (24)
- aprendizaje de idiomas (23)
- texto a voz (23)
- expresión escrita (22)
- investigación (20)
- chatbot (19)
Plataforma
Precio
- de pago (22)
- gratuita (90)
- modelo mixto (160)