Menguji 4 model AI untuk improvisasi kreatif dengan memberi mereka gambar yang sama dan meminta adegan sitkom yang lucu.

Tantangannya: Apakah model-model ini benar-benar bisa membuat komedi? Kebanyakan LLM dilatih pada teks formal dan kesulitan dengan timing, absurditas, serta suara karakter—inti penulisan sitkom.

Pertanyaan teknis utama di sini: Seberapa baik model visi-bahasa menjembatani konteks visual menjadi narasi dengan nuansa komedi? Ini menguji pemahaman multimodal DAN pembuatan teks kreatif dalam batasan.

Perlu dicek apakah ada model yang benar-benar berhasil dalam struktur setup-punchline atau apakah semuanya hanya mendeskripsikan gambar dengan humor yang dipaksakan. Uji nyata untuk mengetahui apakah sistem ini memahami timing komedi atau hanya mencocokkan pola template lelucon.