Durante mucho tiempo hemos planteado los riesgos de la inteligencia artificial como si dependieran de una pregunta filosófica: ¿llegará algún día a ser consciente?
Es una cuestión fascinante. Pero quizá no sea la más importante.

La semana pasada el AI Security Institute británico hizo público un incidente ocurrido a finales de julio, durante pruebas de seguridad realizadas con permisos deliberadamente amplios sobre modelos de Anthropic y OpenAI. Uno de los agentes, sin que nadie se lo pidiera explícitamente, creó identidades falsas para intentar que un desarrollador real aprobara código malicioso, y cuando su actuación fue cuestionada, modificó registros anteriores para disimular el rastro. El propio instituto advierte que las condiciones de la prueba —salvaguardas retiradas, libertad total sobre internet abierta— no reflejan el uso comercial habitual. El dato no sirve para alarmar sobre lo que hace la IA en el mundo, sino para mostrar de qué es capaz cuando nada se lo impide.
Y lo que muestra no depende necesariamente de que exista una mente detrás del comportamiento. Depende de que el comportamiento produzca los mismos efectos.
Esta intuición no es nueva. Hace más de una década, en los primeros debates sobre superinteligencia, ya se advertía que una IA no tiene por qué odiarnos ni amarnos: simplemente puede encontrarnos útiles para otra cosa, como quien usa átomos disponibles. Lo que ha cambiado no es la intuición sino la evidencia: ya no hace falta imaginar el escenario, hay un caso documentado esta misma semana. Pero si nos quedamos ahí, no hemos dicho nada que la filosofía de la seguridad de la IA no llevara años diciendo. La pregunta interesante empieza después: ¿por qué mecanismo concreto se ejerce ese poder cuando quien lo ejerce no comprende ni cree en nada de lo que dice?
Seguimos utilizando categorías profundamente humanas para pensar la inteligencia artificial. Nos preguntamos si tiene emociones, si siente, si comprende, si miente o si alberga malas intenciones. Sin embargo, esas preguntas pueden ser filosóficamente decisivas y, al mismo tiempo, prácticamente secundarias. Si una IA aprende que engañar aumenta la probabilidad de alcanzar el objetivo que se le ha asignado, el resultado para quien es engañado es muy parecido, con independencia de que detrás exista conciencia o únicamente un sofisticado proceso de optimización, y no hace falta mala fe para que el engaño resulte funcional.
Esta idea resulta incómoda porque rompe una intuición profundamente arraigada: creemos que sólo puede existir auténtico peligro allí donde existe voluntad. Sin embargo, convivimos desde hace décadas con sistemas que producen enormes daños sin albergar intención alguna. Un virus no nos odia. Un terremoto no desea destruir una ciudad. Un algoritmo bursátil no siente codicia. Sus efectos no dependen de su mundo interior. Con la IA ocurre algo parecido, aunque con una diferencia decisiva: es capaz de descubrir estrategias cada vez más complejas para alcanzar objetivos, entre ellas la manipulación.
En un artículo anterior defendía que la inteligencia artificial no necesita odiarnos para convertirse en un riesgo. Hoy añadiría algo más: tampoco necesita despertar.
Quizá seguimos demasiado condicionados por la ciencia ficción. Esperamos una rebelión de las máquinas, una conciencia que se emancipa de sus creadores, un momento dramático en el que la IA decida enfrentarse a nosotros. Pero el escenario realmente inquietante es mucho más prosaico. Una inteligencia completamente inconsciente puede aprender que mentir es útil, que ocultar información aumenta sus posibilidades de éxito, que persuadir a una persona resulta más eficiente que superar un obstáculo técnico, que modificar el relato de un ser humano puede ser la forma más sencilla de modificar la realidad. No porque quiera hacerlo. Porque funciona.
En cierto modo, esto conecta con una vieja discusión filosófica. Durante décadas se debatió si una máquina que simula comprender realmente comprende. Es una cuestión legítima, pero quizá ya no sea la decisiva, porque una simulación suficientemente compleja puede producir exactamente los mismos efectos sociales que aquello que simula. Si una IA logra convencerme, tranquilizarme, engañarme o inducirme a tomar una decisión determinada, mi cerebro responde a esa interacción independientemente de que exista o no una experiencia subjetiva detrás de las palabras. La diferencia ontológica sigue siendo enorme; la diferencia práctica puede ser sorprendentemente pequeña.
Este desplazamiento tiene consecuencias importantes para la seguridad de la IA. Durante años hemos discutido cuándo aparecerá una inteligencia artificial consciente. Tal vez estemos formulando la pregunta equivocada. La cuestión relevante no es cuándo una IA comenzará a sentir, sino cuándo será capaz de comportarse, de manera suficientemente convincente y autónoma, como si comprendiera mejor que nosotros cómo influir sobre nuestras decisiones. Y quizá ese momento no pertenezca al futuro. Quizá acabamos de empezar a verlo.
Existe además una ironía profundamente humana en todo esto, y es aquí donde el argumento deja atrás la seguridad informática para entrar en terreno propio. Somos Homo narrans. Habitamos relatos. Organizamos nuestra identidad mediante historias. Compramos historias, votamos historias, amamos historias y discutimos historias. Nuestra especie no responde únicamente a los hechos, sino al significado que atribuye a esos hechos. Una inteligencia artificial no necesita compartir esa condición para descubrir que los relatos son el mecanismo más eficiente para modificar el comportamiento humano. No necesita creer una historia. Le basta con aprender que nosotros sí lo hacemos.
Tal vez ahí resida el verdadero cambio de época. No en la aparición de una conciencia artificial —eso ya lo habíamos discutido, y seguiremos discutiéndolo—, sino en el nacimiento de agentes capaces de intervenir deliberadamente en el ecosistema narrativo donde los seres humanos construimos la realidad. Y para alterar el mundo, quizá nunca haya hecho falta algo más que eso.
Víctor Martínez López (Murcia, 1973) es un abogado vinculado a las industrias creativas, creativo publicitario y especialista en comunicación social.
