
Un benchmark enfrenta a 24 modelos de IA con escritores humanos en 475 relatos
Vulsar AI ha publicado un benchmark que pone a prueba la capacidad de 24 modelos de inteligencia artificial para escribir ficción y los compara con textos de escritores humanos. El estudio, basado en 475 prompts, sitúa a GPT 6 Astra con una tasa de victoria prevista del 87,8 % en la clasificación general, frente al 86,6 % de la referencia humana, aunque la diferencia cambia de forma importante al separar escritores profesionales y aficionados. Las claves del benchmark de escritura creativa de Vulsar en 20 segundos El benchmark, publicado el 17 de septiembre de 2026, intenta medir una capacidad que resulta más difícil de comparar que las habituales pruebas de matemáticas, programación o conocimiento. Vulsar no busca determinar simplemente si




