Una competencia de dibujo entre inteligencias artificiales
Adaptado al nivel A2 de una historia de Hacker News.
Un grupo de personas creó una prueba para cuatro modelos de inteligencia artificial. Los modelos recibieron un lienzo en blanco y herramientas de dibujo. Tenían que copiar una imagen famosa o dibujar algo nuevo a partir de una descripción.
Los modelos participantes fueron GPT-5.6 Sol, Claude Fable 5, Grok 4.5 y Gemini 3.6 Flash. Cada uno dibujó siete imágenes. El costo y la calidad fueron muy diferentes. Claude Fable 5 gastó unos 160 dólares, veinte veces más que GPT-5.6 Sol que solo costó 7.74 dólares.
Los modelos que revisaron mucho su trabajo no siempre mejoraron. Gemini 3.6 Flash se revisó veintitrés veces por dibujo, pero su mejor imagen final fue peor que su mejor versión durante el proceso. GPT-5.6 Sol hizo dibujos con mucho detalle y fue el favorito de los creadores de la prueba. Grok 4.5 casi no produjo nada útil.
Estos resultados son interesantes para aprender cómo trabajan las inteligencias artificiales. Pero los autores del estudio dicen que no es una prueba objetiva sobre la creatividad de las máquinas. Es solo un experimento abierto para ver cómo se comportan los modelos.
Historia original: Hacker News — Lingocito la reescribe en español del nivel A2 y siempre enlaza la fuente.