Hay quien comete huachicol y se van contra quien no lo hace: abogado de Ruffo acusa esto  —  Testigo vincula a Rafael Ojeda Durán y a 'Andy' López Beltrán en presunta red de huachicol fiscal  —  Se declaró culpable “El Jando”, piloto del caso Mayo; coopera con EU  —  Esto pidió el exgobernador de Baja California, Ernesto Ruffo Appel tras ser detenido (+Video)  —  'Es algo orquestado por el gobierno de la 4T': PAN sobre detención de exgobernador de Baja California  —  Suman 8 detenidos por red de huachicol ligada a Ernesto Ruffo: García Harfuch  —  Lo 5 hábitos cotidianos mejoran la salud cognitiva en mayores  —  Rosalía arranca gira por Latinoamérica; conoce su tour  —  ¿Quién es Masad Al – Tamimi, el noveno integrante de LCDLF Mx?   —  Don Omar afirma que tiene 'negocios pendientes' con Daddy Yankee  —  Irá Trump contra terrorismo de extrema izquierda  —  Donald Trump acusa a China de interferir en las elecciones de EU  —   La igualdad marca los duelos España-Argentina, pero en Inglaterra 1966 ganó la Albiceleste  —  Sheinbaum rechaza acusaciones del director de la DEA y lanza fuerte mensaje  —  Dispositivo permite a personas con discapacidad auditiva "comprender" sonidos  —  Elsa Aguirre mantuvo un estrecho vínculo con Veracruz, siempre vestida de blanco  —  Esto propone Monreal ante filtración del audio de la gobernadora Marina del Pilar  —  Esposa del exdirector de Pemex aclara que no otorgó un perdón a su expareja  —  ¿Perdiste tu licencia de conducir? Checa lo que debes hacer para tramitarla  —  Quiso quedarse con una casa sin ser el dueño; así lo descubrieron

Científicos comprueban que la IA aún no ha alcanzado el razonamiento humano complejo

06 febrero, 2026 | Tecnociencia

Un equipo internacional de científicos comprobó que la inteligencia artificial (IA) sigue cometiendo errores a la hora de responder preguntas que requieren razonamiento conceptual y no meras búsquedas en internet, lo que revela que aún no iguala el pensamiento humano en tareas académicas complejas.

Según detalló este jueves en un comunicado la Universidad de Granada (UGR), de España, la investigación nació con el objetivo de determinar si los actuales grandes modelos de lenguaje (LLM) poseen una amplia y verdadera capacidad de resolución creativa o si, por el contrario, su funcionamiento se limita a una sofisticada gestión de los datos que esos modelos rescatan de la nube.

Para ello, la comunidad científica diseñó una batería de preguntas de alta complejidad técnica y conceptual como parte de su investigación, llamada ‘Humanity’s Last Exam’ (‘Último Examen de la Humanidad’, en español), publicada en la revista Nature.

Así, un equipo formado por 1.100 científicos de todos los ámbitos de la ciencia y las humanidades -entre los que se encuentra la española María Cruz Boscá, de la UGR- sometió a la IA a un «gran examen» para valorar su réplica a preguntas de respuesta inequívoca y verificable pero que requieren más que una búsqueda en internet.

Cada pregunta tiene una solución conocida que es inequívoca y verificable, pero que no puede responderse rápida y fácilmente mediante una búsqueda en internet.

Como detalla el artículo ‘Una base de referencia de preguntas académicas de nivel experto para evaluar las capacidades de la IA’, el resultado es que, a día de hoy, incluso los modelos más avanzados de IA tropiezan con conceptos científicos profundos y heredan errores de los manuales clásicos, lo que pone de relieve una marcada diferencia entre las capacidades actuales de los LLM y las de los expertos humanos en las diferentes preguntas académicas planteadas, referentes a diversos campos científicos.

Según explicó la profesora Boscá, que puso a prueba los límites del razonamiento artificial en el ámbito de la física cuántica, su investigación comprobó que las inteligencias artificiales no lograron elegir las respuestas correctas cuando tenían que realizar una profunda comprensión conceptual.

En una de las cuestiones, relacionada con la paradoja Einstein-Podolsky-Rosen, la máquina falló debido a un sesgo interpretativo clásico, asumiendo una realidad objetiva en la medición que contradice los principios cuánticos.

En otro caso, relativo al experimento Stern-Gerlach, la IA reprodujo un error factual que se repite en numerosos manuales científicos, demostrando que estos sistemas pueden perpetuar equivocaciones bibliográficas si no se les entrena para discernir la respuesta correcta.

No obstante, la doctora Boscá subrayó que los sistemas actuales de LLM más avanzados trascendieron ya la mera búsqueda de información para comenzar a realizar análisis reflexivos complejos a partir de los datos disponibles.

«El verdadero hito llegará cuando la IA no solo evite errar en el conocimiento establecido, sino que además sea capaz de plantear nuevas preguntas y ofrecer respuestas a incógnitas científicas que hoy en día los humanos aún no hemos logrado resolver», concluyó.