Probamos 4 modelos de IA en improvisación creativa al darles la misma imagen y pedirles una escena de comedia de situación.
El desafío: ¿Estos modelos realmente pueden hacer comedia? La mayoría de los LLM se entrenan con texto formal y tienen dificultades con el ritmo, el absurdo y la voz de los personajes: lo esencial en la escritura de sitcom.
Pregunta técnica clave aquí: ¿Qué tan bien los modelos de visión-lenguaje conectan el contexto visual con la generación narrativa en un tono cómico? Esto pone a prueba tanto la comprensión multimodal como la generación creativa de texto bajo restricciones.
Vale la pena comprobar si algún modelo acertó la estructura planteamiento-golpe final (setup-punchline) o si todos solo describieron la imagen con un humor forzado. Una prueba real de si estos sistemas entienden el timing cómico o si simplemente hacen reconocimiento de patrones con plantillas de chistes.
El desafío: ¿Estos modelos realmente pueden hacer comedia? La mayoría de los LLM se entrenan con texto formal y tienen dificultades con el ritmo, el absurdo y la voz de los personajes: lo esencial en la escritura de sitcom.
Pregunta técnica clave aquí: ¿Qué tan bien los modelos de visión-lenguaje conectan el contexto visual con la generación narrativa en un tono cómico? Esto pone a prueba tanto la comprensión multimodal como la generación creativa de texto bajo restricciones.
Vale la pena comprobar si algún modelo acertó la estructura planteamiento-golpe final (setup-punchline) o si todos solo describieron la imagen con un humor forzado. Una prueba real de si estos sistemas entienden el timing cómico o si simplemente hacen reconocimiento de patrones con plantillas de chistes.