La 16 GB no corre Qwen, TTS, VoiceStudio, MuseTalk y Comfy juntos. Arrancar uno apaga los demás.
Enviar cede la GPU a Qwen (apaga TTS/VoiceStudio/MuseTalk/Comfy) y espera a que cargue el modelo (~30–40 s). API: POST /v1/chat/completions · LAN: http://192.168.30.248:8889/v1
9 voces · 10 idiomas. Arrancar esto apaga Qwen/Comfy. API: POST /v1/audio/speech y POST /api/tts/speak · LAN: http://192.168.30.248:8891/v1/audio/speech
ElevenLabs local. UI: http://192.168.30.248:3901/ · API: POST /api/voicestudio/speak
API: POST /api/musetalk/generate (multipart source + audio) · LAN: http://192.168.30.248:8893/generate
Texto y/o imagen inicial/final · 24 fps · rango entrenado ~5–15 s (máx. práctico 362 frames ≈ 15 s). Arrancar esto apaga Qwen. ComfyUI: http://192.168.30.248:8188/
Destilado FP8 · ~4 steps · 1024² · ~13 GB VRAM. Formato de salida: PNG o WebP. Usa el mismo slot ComfyUI (apaga Qwen/TTS/MuseTalk).
Orquesta Guion → Imagen → Audio → Vídeo → Lipsync con el slot GPU. Puedes lanzar varias variantes (distintas IAs) y compararlas.
Flujo base (16 GB · un motor a la vez):
Plantillas listas: rápido, + MuseTalk, voz clon, imagen propia→H3, personalizado. Cada corrida queda guardada para comparar motores distintos en el mismo tema.
Crea y sigue proyectos en MariaDB chispa_explora. Día a día y avance general por canal/idioma.
Resultados guardados en disco. Ver, descargar o eliminar. VoiceStudio se archiva al sintetizar desde este panel.