El debate sobre la seguridad de la inteligencia artificial suele centrarse en qué modelo es más potente o cuál lidera los rankings de rendimiento. Sin embargo, un nuevo informe del Future of Life Institute cambia completamente el foco. Su AI Safety Index de verano de 2026 evalúa cómo gestionan los riesgos las principales empresas del sector y el resultado es llamativo: ninguna alcanza un notable y la mejor calificación apenas llega a un C+.
Las claves del AI Safety Index en 30 segundos
- El Future of Life Institute ha evaluado nueve desarrolladores de IA en 37 indicadores repartidos en seis categorías.
- Anthropic obtiene la mejor nota (C+), seguida de OpenAI y Google DeepMind, ambas con un C.
- xAI, DeepSeek y Mistral suspenden el examen global de seguridad.
- El informe advierte de un retroceso en algunos compromisos públicos sobre seguridad y del creciente interés de varias compañías por contratos de defensa.
- La categoría peor valorada es la denominada «seguridad existencial», donde ninguna empresa supera un C-.
El índice ha sido elaborado por un panel independiente formado por siete investigadores especializados en seguridad, gobernanza y alineamiento de inteligencia artificial. La evaluación analiza seis grandes áreas: evaluación de riesgos, daños actuales, marcos de seguridad, seguridad existencial, gobernanza y responsabilidad, e intercambio de información. Para ello utiliza 37 indicadores obtenidos a partir de documentación pública y de respuestas facilitadas por varias compañías participantes.
La clasificación deja pocos motivos para el optimismo
Anthropic vuelve a ocupar la primera posición gracias a una combinación de mayor transparencia, investigación en seguridad y estructuras de gobernanza relativamente más desarrolladas, aunque el propio panel considera que todavía existen importantes carencias. OpenAI y Google DeepMind completan el grupo de cabeza con una calificación de C.
Meta mejora respecto a la edición anterior y asciende hasta la cuarta posición con un D+, mientras que Z.ai y Alibaba Cloud obtienen un D-. En el extremo opuesto aparecen xAI, DeepSeek y Mistral, que reciben un suspenso en la valoración global.

Uno de los aspectos más llamativos del informe es que el suspenso no se concentra en una región concreta. Según el panel, existe al menos una empresa suspendida en Estados Unidos, China y Europa, lo que lleva a los autores a concluir que la falta de medidas suficientes de seguridad constituye un problema global y no exclusivamente regulatorio.
La regulación europea no garantiza mejores resultados
El caso de Mistral ocupa un lugar destacado en las conclusiones del informe.
Los autores subrayan la aparente contradicción entre el liderazgo regulatorio de la Unión Europea en materia de inteligencia artificial y la posición de su principal desarrollador de modelos fundacionales, que obtiene la peor puntuación del estudio.
No se trata de una valoración sobre la calidad tecnológica de sus modelos, sino sobre aspectos como la existencia de marcos públicos de seguridad, mecanismos de gobernanza, transparencia o gestión de riesgos.
El informe recomienda a Mistral publicar un marco de seguridad más completo, reforzar su estrategia de alineamiento y mejorar sus resultados en las evaluaciones relacionadas con la seguridad de los modelos.
La seguridad militar emerge como una nueva preocupación
Uno de los cambios que más preocupa al panel no aparece reflejado únicamente en las notas.
El informe sostiene que entre 2024 y 2026 varias compañías modificaron sus políticas sobre el uso militar de sus modelos. Empresas como Anthropic, OpenAI, Google DeepMind y Meta, que anteriormente limitaban este tipo de aplicaciones, habrían flexibilizado esos compromisos mientras aumentaba el interés por colaborar con el sector de defensa.
En el caso de Anthropic, el panel menciona expresamente «compromisos militares cuestionables» entre los factores que requieren mejoras, aunque la compañía continúa liderando la clasificación general.
Los revisores también consideran que algunas empresas han suavizado compromisos anteriores relacionados con la posibilidad de detener el desarrollo o despliegue de modelos cuando se alcanzaran determinados umbrales de riesgo, algo que califican como un retroceso respecto a posiciones adoptadas en años anteriores.
La seguridad existencial sigue siendo la asignatura pendiente
Si existe una categoría donde el consenso del panel es especialmente crítico, esa es la denominada seguridad existencial.
Ninguna de las nueve compañías supera un C- y la mayoría obtiene calificaciones D o F. Según el informe, aunque existen iniciativas como clasificadores de seguridad, investigación en interpretabilidad o propuestas de gobernanza, las medidas actuales siguen considerándose insuficientes frente a los riesgos asociados a sistemas de IA cada vez más avanzados.
Los autores también cuestionan que muchas estrategias actuales se centren principalmente en detectar comportamientos peligrosos en lugar de prevenirlos desde el diseño del sistema.
Más transparencia, pero todavía pocas garantías
Otro de los mensajes del AI Safety Index es que prácticamente todas las grandes compañías publican hoy más documentación sobre seguridad que hace dos años.
Sin embargo, el panel considera que muchos de esos marcos siguen adoleciendo de problemas importantes: umbrales poco cuantificables, ausencia de auditorías independientes, escasa claridad sobre quién puede detener un despliegue y diferencias entre los compromisos públicos y las decisiones comerciales posteriores.
En un contexto donde los modelos de IA continúan aumentando sus capacidades y se integran en sectores críticos, el informe concluye que los avances en materia de seguridad no están evolucionando al mismo ritmo que el desarrollo tecnológico.
Preguntas frecuentes
¿Qué es el AI Safety Index?
Es un informe elaborado por el Future of Life Institute que evalúa las prácticas de seguridad de las principales empresas de inteligencia artificial mediante 37 indicadores repartidos en seis categorías.
¿Qué empresa obtiene la mejor puntuación?
Anthropic encabeza la clasificación con un C+, seguida por OpenAI y Google DeepMind, ambas con un C.
¿Qué compañías suspenden?
El informe otorga una calificación global de suspenso a xAI, DeepSeek y Mistral.
¿Cuál es la principal conclusión del estudio?
Que, según el panel de expertos, ninguna de las grandes empresas alcanza todavía un nivel de seguridad considerado plenamente satisfactorio y que los avances en gobernanza y mitigación de riesgos siguen siendo insuficientes frente al rápido desarrollo de la IA.
vía: AI Safety Index — Summer 2026 | Future of Life Institute