IA SMART LOCAL

192.168.30.248 · RTX 5060 Ti 16 GB · un occupant de GPU a la vez
Auto-refresh

GPU

CPU / RAM

GPU exclusiva

La 16 GB no corre Qwen, TTS, VoiceStudio, MuseTalk y Comfy juntos. Arrancar uno apaga los demás.

Cargando slot…
Servicios

Qwen3.8-27B · chat OpenAI /v1

Enviar cede la GPU a Qwen (apaga TTS/VoiceStudio/MuseTalk/Comfy) y espera a que cargue el modelo (~30–40 s). API: POST /v1/chat/completions · LAN: http://192.168.30.248:8889/v1

Sin respuesta aún. Si MuseTalk u otro servicio está activo, Enviar lo apaga y carga Qwen.

Qwen3-TTS 1.7B · CustomVoice

9 voces · 10 idiomas. Arrancar esto apaga Qwen/Comfy. API: POST /v1/audio/speech y POST /api/tts/speak · LAN: http://192.168.30.248:8891/v1/audio/speech

Sin audio aún.

VoiceStudio · clonación, doblaje, audiolibros

ElevenLabs local. UI: http://192.168.30.248:3901/ · API: POST /api/voicestudio/speak

Sin audio aún. El primer arranque baja ~2.4 GB de modelos.

MuseTalk 1.5 · lipsync foto/vídeo + audio

API: POST /api/musetalk/generate (multipart source + audio) · LAN: http://192.168.30.248:8893/generate

Sube una foto o vídeo con cara visible y un WAV/MP3.

MiniMax-H3 · FL2VA INT8 + Turbo LoRA 4-steps

Texto y/o imagen inicial/final · 24 fps · rango entrenado ~5–15 s (máx. práctico 362 frames ≈ 15 s). Arrancar esto apaga Qwen. ComfyUI: http://192.168.30.248:8188/

Sin imagen = solo texto. Con imagen inicial = I2V. Con inicial+final = first/last frame.

FLUX.2 Klein 4B · texto→imagen / edición

Destilado FP8 · ~4 steps · 1024² · ~13 GB VRAM. Formato de salida: PNG o WebP. Usa el mismo slot ComfyUI (apaga Qwen/TTS/MuseTalk).

Sin trabajo aún. En modo edición sube una imagen de referencia y describe el cambio.

Pipeline Chispa

Orquesta Guion → Imagen → Audio → Vídeo → Lipsync con el slot GPU. Puedes lanzar varias variantes (distintas IAs) y compararlas.

Flujo base (16 GB · un motor a la vez):

  1. Guion — Qwen3.8 reescribe escena + narración (opcional).
  2. Imagen — FLUX.2 Klein 4B (still / personaje) o imagen subida.
  3. Audio — Qwen3-TTS o VoiceStudio (o omitir: H3 genera audio).
  4. Vídeo — MiniMax-H3 FL2VA usando el still como imagen inicial.
  5. Lipsync — MuseTalk 1.5 (opcional) sobre cara + audio.

Plantillas listas: rápido, + MuseTalk, voz clon, imagen propia→H3, personalizado. Cada corrida queda guardada para comparar motores distintos en el mismo tema.

Plantilla
Motores (personalizable)
Elige plantilla y lanza. Puedes lanzar otra variante del mismo tema para comparar.
Corridas
Marca 2–4 corridas en la lista de Pasos, o mira el resultado de la seleccionada:

Proyectos (MySQL)

Crea y sigue proyectos en MariaDB chispa_explora. Día a día y avance general por canal/idioma.

Selecciona un proyecto
Bitácora reciente
El proyecto Chispa Explora ya se siembra automáticamente al arrancar.

Galería por aplicación

Resultados guardados en disco. Ver, descargar o eliminar. VoiceStudio se archiva al sintetizar desde este panel.