ElevenLabs es una plataforma de audio con IA que cubre síntesis de voz, clonación, transcripción, doblaje y generación musical. Admite texto, audio, vídeo e imagen, y devuelve voz sintética, efectos sonoros, música, transcripciones con marcas temporales y vídeo doblado.
Entre sus funciones con nombre propio están Text to Speech, de texto a voz; Scribe, el modelo de transcripción, que cubre noventa y nueve idiomas; Voice Changer, que cambia la voz de una grabación conservando la interpretación; la clonación de voz, en una modalidad instantánea y otra profesional; Voice Design, que crea una voz nueva describiéndola con palabras; Dubbing Studio, que dobla un vídeo conservando la voz y la emoción; Studio, un editor para proyectos de audio largos como audiolibros; Sound Effects y Music; y Voice Isolator, que separa la voz del ruido de fondo. Los modelos se ofrecen en variantes según se prime la expresividad o la latencia.
Dispone de API y de bibliotecas de desarrollo, y de una aplicación lectora para móvil.
La versión gratuita concede diez mil créditos al mes, unos diez minutos de voz, con acceso a la mayoría de las herramientas y tres proyectos de edición, pero exige atribución y no autoriza el uso comercial, que empieza en el plan de seis dólares.
Es la herramienta del catálogo con el tratamiento más explícito del español: su repertorio distingue y etiqueta voces en castellano, mexicano, latinoamericano y argentino.