¿Es hora de medir la IA de otra forma? La propuesta en Science para evaluar sus riesgos e impacto real

Desde Silicon Valley hasta China, buena parte de la carrera mundial por la inteligencia artificial persigue un mismo objetivo: desarrollar una IA general capaz de igualar o superar las capacidades humanas y, a partir de ahí, una “superinteligencia”. Sin embargo, un artículo publicado en Science y liderado por el investigador de la Universitat Politècnica de València, José Hernández-Orallo, cuestiona esta visión y plantea un cambio profundo en la forma de entender y evaluar los sistemas de IA.

En el artículo participan también investigadores de la Universidad de Cambridge, la Universidad de Princeton, el MIT (siglas en inglés del Instituto Tecnológico de Massachusetts) y Google DeepMind.

Los autores sostienen que la obsesión por medir si una inteligencia artificial alcanza o supera el nivel humano reproduce, en el fondo, la misma lógica del histórico Test de Turing, “un referente que durante décadas marcó el desarrollo de la disciplina pero que hoy resulta insuficiente para evaluar los sistemas actuales”, apunta Hernández-Orallo, investigador del Instituto VRAIN de la UPV y miembro de ValgrAI.

Frente a esta visión, y para evitar recaer en concepciones antropomórficas de la inteligencia artificial, el equipo investigador propone un nuevo marco basado en tres perspectivas complementarias: en primer lugar, exploran cómo evaluar diferentes perfiles cognitivos, compuestos de capacidades y propensiones abstractas, en diversidad.

En segundo lugar, se preguntan cómo se puede evaluar la cognición humana tal como se transforma por nuevas formas de pensar junto a la IA -en lugar de preguntarse qué tareas pueden sustituir las máquinas, los investigadores proponen analizar cómo cambia la forma de pensar cuando humanos e IA trabajan conjuntamente.

Por último, el equipo de la UPV, Cambridge, Princeton, el MIT y Google DeepMind también defiende que, en lugar de comprobar cómo de alineada está la IA con los valores humanos, se tiene que evaluar el efecto global: los beneficios y los daños de las intervenciones de la IA en la sociedad. Y para ello proponen analizar los beneficios y los posibles riesgos que puede generar cada sistema de IA antes de su despliegue, utilizando entornos de prueba que permitan simular distintos escenarios y anticipar su impacto. “El objetivo final es responder a una pregunta clave: si la sociedad estará realmente mejor después de incorporar una determinada inteligencia artificial”, añade José Hernández-Orallo.

Según los investigadores, el desarrollo de nuevos métodos de evaluación resulta especialmente urgente en un momento de enorme aceleración tecnológica, marcado por la rápida evolución de los modelos basados en arquitecturas transformer y la aparición constante de nuevos agentes de inteligencia artificial. En este contexto, sostienen que el principal desafío ya no consiste únicamente en construir modelos cada vez más potentes, sino en desarrollar herramientas que permitan comprender su comportamiento, explicar sus decisiones y anticipar tanto sus beneficios como sus riesgos.

“El futuro de la inteligencia artificial dependerá tanto de su capacidad técnica como de nuestra capacidad para evaluarla correctamente. Solo así será posible impulsar un desarrollo responsable, seguro y alineado con las necesidades reales de la sociedad”, concluye José Hernández-Orallo.

Europa reconoce la apuesta de Cataluña por simplificar los trámites en las empresas

La Ventanilla Única Empresarial (FUE) ha recibido un Reconocimiento Especial (Special Recognition) en los European Public Sector Awards (EPSA) 2025-2026, los premios de referencia en innovación pública que convoca el European Institute of Public Administration (EIPA) en Maastricht (Países Bajos). Esta categoría distingue a los proyectos con un impacto sostenido en el tiempo, la capacidad de adaptarse a los cambios y una contribución destacada a la modernización de la Administración.

Iberia renueva su alianza con Disney como aerolínea preferente para Disneyland París, Orlando y cruceros

Iberia y Destinos Disney (Disneyland Paris, Walt Disney World Resort en Orlando y Disney Cruise Line) han cerrado la renovación por tres años de su acuerdo de colaboración estratégica, mediante el cual la compañía aérea del grupo IAG mantendrá su condición de aerolínea preferente para el mercado español en los viajes hacia las instalaciones y cruceros de la firma de entretenimiento.

El Hospital Clínic de Barcelona refuerza su infraestructura tecnológica con SUSE

El hospital incorpora SUSE Multi-Linux Manager, SUSE Multi-Linux Support y SUSE Linux Enterprise Server (SLES) con Long Term Service Pack Support (LTSS) para centralizar la administración de un entorno Linux heterogéneo, garantizar soporte empresarial para los sistemas críticos y heredados, y mejorar la aplicación y cumplimiento normativo.

VisionLab, Acerinox y la Universidad Rey Juan Carlos, entre los finalistas de los Advanced Manufacturing Awards

Los Advanced Manufacturing Awards celebran su quinta edición con un récord de 73 finalistas, la cifra más alta alcanzada hasta el momento. Los premios se entregarán en el marco de Advanced Manufacturing Madrid, el evento líder de la industria fabricante en España organizado por Easyfairs, y reconocerán iniciativas que contribuyen a mejorar la fabricación, entre las que figuran propuestas de VisionLab, Acerinox y la Universidad Rey Juan Carlos.