Stable Diffusion no es un sitio web sino una familia de modelos abiertos de generación de imágenes por difusión, desarrollada por Stability AI. Los pesos y el código se publican y se descargan libremente, lo que permite ejecutarlos en el propio ordenador sin enviar nada a un servidor. La generación actual es la 3.5, en tres tamaños: Large, Large Turbo —que produce una imagen en cuatro pasos— y Medium, pensado para equipos domésticos. SDXL y las versiones anteriores siguen disponibles como modelos heredados.
Admite instrucciones de texto e imágenes de entrada, con lo que cubre generación desde cero, transformación de una imagen existente, relleno de zonas y guiado por estructura. La salida son imágenes de mapa de bits.
El uso habitual pasa por interfaces de terceros que se instalan en local, como ComfyUI o AUTOMATIC1111, que requieren una tarjeta gráfica; sin instalar nada se puede probar en los espacios oficiales de Hugging Face o a través de Stable Assistant, el servicio de pago de la propia Stability. Existe también API, y un ecosistema muy amplio de modelos derivados y adaptadores publicados por la comunidad.
Los modelos son gratuitos bajo licencia comunitaria: el uso no comercial es libre y el comercial también lo es para particulares y empresas por debajo del millón de dólares de facturación anual, previo registro. Las instrucciones funcionan mejor en inglés y la generación de texto dentro de la imagen es poco fiable.