Herramientas digitales: generación de audio
Nº de entradas: 11Detalles Cerrar β
Precio: modelo mixto
Etiquetas: creación de imágenes creación de vídeos generación de audio
Descripción: Firefly es la plataforma de IA generativa de Adobe. Reúne en una sola interfaz la generación de imagen, vídeo y audio, con los modelos propios de Adobe y más de treinta modelos de terceros. Admite texto, imágenes de referencia, bocetos, vídeo y audio.En imagen ofrece texto a imagen, imagen a imagen, boceto a imagen, relleno generativo, expansión generativa, escalado de resolución y eliminación de objetos o de personas. En vídeo, generación desde texto o imagen, editor, escalado, traducción de...
Detalles Cerrar β
Precio: modelo mixto
Etiquetas: texto a voz transcripción de audio clonación de voz generación de audio
Descripción: ElevenLabs es una plataforma de audio con IA que cubre síntesis de voz, clonación, transcripción, doblaje y generación musical. Admite texto, audio, vídeo e imagen, y devuelve voz sintética, efectos sonoros, música, transcripciones con marcas temporales y vídeo doblado.Entre sus funciones con nombre propio están Text to Speech, de texto a voz; Scribe, el modelo de transcripción, que cubre noventa y nueve idiomas; Voice Changer, que cambia la voz de una grabación conservando la interpretación;...
Detalles Cerrar β
Precio: modelo mixto
Etiquetas: análisis de textos resumen de textos generación de audio fichas de estudio
Descripción: Gemini Notebook —hasta julio de 2026 NotebookLM— es el cuaderno de investigación con IA de Google. Su rasgo definitorio es que responde anclado exclusivamente a las fuentes que el usuario sube, y cita el pasaje exacto del que sale cada afirmación, en lugar de responder desde el conocimiento general del modelo.Admite PDF, documentos y presentaciones de Google, texto pegado, páginas web, vídeos de YouTube y audio, con un límite de quinientas mil palabras o doscientos megabytes por fuente. A...
Detalles Cerrar β
Precio: modelo mixto
Etiquetas: creación de materiales generación de textos creación de imágenes generación de audio
Descripción: Gemini Storybook es una función de la aplicación Gemini, de Google, que genera cuentos ilustrados a partir de una descripción escrita. Admite además la subida de fotos, PDF y otros archivos para incorporarlos al relato, y devuelve un libro de diez a doce páginas con texto, ilustraciones y narración de audio, listo para leer a pantalla completa.Se abre desde el apartado de Gems de Gemini o escribiendo una petición del tipo «crea un cuento sobre…», y tarda uno o dos minutos en producir el libro....
Detalles Cerrar β
Plataforma: web
Precio: modelo mixto
Etiquetas: chatbot generación de textos creación de imágenes creación de vídeos
Descripción: Google AI Studio es el entorno web de Google para probar los modelos Gemini y construir aplicaciones con ellos desde el navegador. Sucede a Google MakerSuite. Admite texto, imágenes, audio, vídeo, documentos y pantalla compartida en directo, y devuelve texto, código, salida estructurada, imágenes, vídeo, voz y música según el modelo que se elija.En el modo Build se describe en lenguaje natural la aplicación que se quiere y el sistema genera el código y una vista previa funcional, que se retoca...
Detalles Cerrar β
Plataforma: web Android iOS Windows Mac
Precio: modelo mixto
Etiquetas: creación de vídeos creación de imágenes generación de audio creación de materiales
Descripción: Kling AI es la plataforma de generación de vídeo e imagen de la empresa china Kuaishou. Admite texto, imágenes, imágenes de referencia de elementos y personajes, audio para la sincronía labial y vídeo existente; devuelve clips de tres a quince segundos, con audio generado a la vez y resolución que llega al 4K nativo en su modelo más reciente.Entre sus funciones con nombre propio están el audio nativo, que genera la banda sonora junto con la imagen y permite controlar el tono de voz; el control...
Detalles Cerrar β
Plataforma: web
Precio: de pago
Etiquetas: chatbot generación de textos creación de imágenes generación de audio
Descripción: OpenAI Platform es el entorno para desarrolladores de OpenAI, separado de ChatGPT: da acceso por API a los modelos de la empresa y a las herramientas para construir aplicaciones con ellos. Admite texto, imágenes, audio, archivos y esquemas de datos, y devuelve texto, JSON estructurado, imágenes, audio y vídeo.La Responses API es la vía principal de llamada a los modelos, con herramientas integradas de búsqueda web, búsqueda en archivos, intérprete de código y uso del ordenador. La Realtime API...
Detalles Cerrar β
Plataforma: web Android iOS Windows Mac
Precio: modelo mixto
Etiquetas: chatbot generación de textos creación de imágenes creación de vídeos
Descripción: Poe es una plataforma de Quora, Inc. que reúne en una sola interfaz modelos de inteligencia artificial de distintos proveedores y bots creados por la comunidad. Admite texto, archivos adjuntos, imágenes y voz, y devuelve texto, imágenes, vídeo, audio y aplicaciones web interactivas, según el modelo que se elija.El Multi-bot chat permite convocar varios bots en un mismo hilo con una mención con arroba y comparar sus respuestas. La Poe Creator Platform reúne las vías de creación: Prompt Bots, que...
Detalles Cerrar β
Precio: modelo mixto
Etiquetas: creación de vídeos edición de vídeos generación de audio creación de materiales
Descripción: Runway es una plataforma de generación y edición de vídeo, imagen y audio con IA, desarrollada por la empresa estadounidense del mismo nombre. Admite texto, imágenes, vídeo, audio y vídeo de referencia de una interpretación; devuelve vídeo, imagen y audio, y en los planes altos formatos profesionales como ProRes, secuencias de imágenes y alto rango dinámico.Sus modelos y funciones tienen nombre propio: Gen-4.5 es el modelo principal de vídeo y Gen-4 Turbo la versión rápida; Aleph edita un vídeo...
Detalles Cerrar β
Precio: modelo mixto
Etiquetas: canciones generación de música generación de audio creación de materiales
Descripción: Suno es un generador de canciones completas —letra, voz cantada e instrumentación— a partir de una descripción escrita, desarrollado por la empresa estadounidense del mismo nombre. Admite texto, audio subido y la grabación de la propia voz, y devuelve canciones, vídeo y, en los planes de pago, hasta doce pistas separadas.Entre sus funciones con nombre propio están Voices, que graba la voz del usuario una vez y la reutiliza en cualquier canción; las Personas, que fijan el carácter vocal y de...
Detalles Cerrar β
Precio: modelo mixto
Etiquetas: canciones generación de música generación de audio creación de materiales
Descripción: Udio es un generador de música con IA —canciones con voz e instrumentación a partir de una descripción escrita— desarrollado por Uncharted Labs. Admite texto, con el estilo y la letra, y audio subido en los planes de pago; canta en español y genera letras en español, aunque la interfaz está en inglés.Entre sus funciones están el control de voz, que guarda y mezcla estilos vocales; la mezcla de estilos; Extend, que alarga una pieza; Remix; el relleno, que regenera un fragmento interno sin...
Clasificación
- creación de materiales (72)
- vocabulario (37)
- creación de actividades (34)
- materiales interactivos (33)
- colaboración (28)
- creación de imágenes (27)
- creación de vídeos (27)
- evaluación (27)
- juegos (27)
- creación de cuestionarios (24)
- aprendizaje de idiomas (23)
- texto a voz (23)
- expresión escrita (22)
- investigación (20)
- chatbot (19)
Plataforma
Precio
- de pago (22)
- gratuita (90)
- modelo mixto (160)