Escribes lo que quieres escuchar. El sistema planifica la pista, el arte y el corte del clip en la misma mesa — con la cámara y la fotografía aprendidas de clips reales ya analizados. Aprobar por fase, publicar en la vitrina, salir en el canal.
Recibe una frase y devuelve música, portada y clip. Antes de gastar cualquier cosa, escribe un plano.json con la estructura de la pista, el concepto del arte y el corte del vídeo — y solo entonces ejecuta, fase por fase, con tu aprobación.
Mira un clip y devuelve lo que la cámara hizo: paleta en hex, luz, lente, plano a plano con timecode, cortes por minuto y prompts por escena. No es transcripción de habla — es lectura de dirección de fotografía y montaje.
Es el gateway: recibe el comando en Telegram, crea el trabajo, organiza la cola, activa el worker y devuelve el resultado. Es por él que los dos se convierten en un comando de una línea, sin terminal.
Planificar es barato, ejecutar es caro. Toda la calidad se decide antes del primer centavo — por eso el producto de musicavideo no es el archivo, es el plano.json.
Pedir “haz una música sobre X” a un agente genérico entrega una pista cualquiera, una portada que no conversa con ella y ningún clip: los tres salen desconectados porque nunca hubo un plan común. Aquí la estructura de la música, el concepto de la portada y el corte del clip se deciden juntos, mirando dos bancos de material medido — estilos musicales (BPM, tono, instrumentación, voz) y referencias visuales reales provenientes de analisevideo. La ejecución es solo la consecuencia.
bash musicavideo.sh plano "música de virada, rock femenino,
sobre quien construye en silencio y ahora cobra"
Mandas una frase. Sale música, portada y clip — en fases, aprobando cada parte, y sin gastar nada hasta que mandes gastar. Tiene panel local para escuchar, comparar, mandar a la papelera y aprobar lo que sube a la vitrina.
bash analisevideo.sh analisa <url|arquivo>
bash analisevideo.sh prompts <slug>
Análisis visual y cinematográfico con Gemini, archivado en una base local buscable. No es transcripción de habla: sale lo que un director de fotografía, un montador y un productor musical ven — paleta en hex, esquema de luz, lente aparente, plano a plano con timecode, cortes por minuto, y de 5 a 10 prompts por escena listos para Kling, Veo o Seedance.
/musicavideo música de virada, rock femenino,
sobre quien construye en silencio y ahora cobra
Mandas la frase en el chat. El bot crea el trabajo, lo pone en la cola, el worker ejecuta y los archivos vuelven a ti en Telegram — sin abrir terminal, sin estar frente a la máquina. Las fases se detienen esperando tu aprobación y reanudan cuando respondes.
/analisevideo <link do clipe>
El clip se analiza y entra en la base de referencia — la misma que el plan de la próxima pista consultará. Los dos proyectos se alimentan: lo que analizas hoy mejora lo que produces mañana.
El panel local es donde se decide. La vitrina es solo lectura — con una excepción: el like del público, que vuelve al panel.
Desde sertanejo moderno hasta folk nórdico y house — cada una con la solicitud original, la letra, los prompts y la edición visibles en la ficha.
Los videoclips reales analizados cuadro a cuadro se convierten en la base visual de referencia que consulta el plano.
El código es la URL de la página en la vitrina — la producción tiene dirección fija, no desaparece en el feed.
La cuadrícula con las portadas y los reproductores, la ficha por MVD-000 con las versiones apiladas y los prompts, y la pestaña de análisis en texto. Los vídeos y las pistas se sirven directamente del dataset público en Hugging Face.
Es donde las producciones salen en vídeo, en formato corto. La vitrina muestra cómo cada una fue hecha; el canal muestra su reproducción.
El plano es el producto. La música, la portada y el videoclip son lo que queda cuando las tres decisiones se toman en la misma mesa.
Vitrina abierta, sin login. Las producciones también salen en el canal @amoanimais2k.