Convierte cualquier vídeo en un prompt listo para usar. La IA de visión describe cada fotograma y el modelo de lenguaje escribe el prompt — todo en tu dispositivo.
Tus ideas y prompts nunca salen de tu dispositivo. Sin subidas, sin registros, sin vigilancia. En cada generación.
El modelo corre en TU hardware, así que nadie paga servidores. Sin claves API, sin cuotas, sin muros de pago: genera 100 prompts al día.
Tras la descarga única, el modelo vive en la caché de tu navegador. Apaga el Wi-Fi y seguirá generando: modo avión, sin problema.
Sin cuenta, sin correo, sin analíticas sobre tus prompts. El modelo no sabe quién eres — y nadie más tampoco.
No. Los fotogramas se extraen y describen por completo en tu navegador. No se sube nada: no existe un servidor que pudiera recibirlo. Carga la página, activa el modo avión y sigue funcionando.
No: reconstruye un prompt a partir de lo visible (sujeto, acciones, cámara, luz, estilo). El prompt original no se puede recuperar de un vídeo, así que el resultado es una interpretación honesta.
Sí: un modelo visual compacto describe los fotogramas — Estándar (~560 MB) o Alta precisión (~1,5 GB) — y el modelo de texto que ya usas redacta el prompt final.
Cualquier formato que tu navegador pueda reproducir (MP4, WebM, MOV y más) — y sin límite de tamaño, porque el vídeo nunca sale de tu dispositivo. Los fotogramas se extraen localmente, así que un vídeo más largo solo tarda un poco más en analizarse.
La IA reconstruye un prompt a partir de lo que los fotogramas muestran: sujeto, acciones, cámara, iluminación, estilo. No puede recuperar el prompt original del vídeo — pero produce una interpretación honesta y lista para usar que puedes refinar.