En primer lugar decir que trataremos este asunto desde el punto de vista de lo dice el budismo al respecto de la mente, por eso pongo este texto aquí. Lo otro es que, dentro de las posibilidades de las diversas formas de IA, nos centraremos en los LLMs, es decir los modelos de lenguaje gigantescos, que es lo que hoy solemos relacionar con la IA (ChatGPT, etc...) y que es lo que ha explotado estos últimos años.
El texto será corto y por tanto con grandes simplificaciones pero puede ampliarse si hace falta y entrar en detalles.
Lo primero es que hemos relacionado de forma estrecha IA y LLM, es decir hemos relacionado inteligencia y lenguaje. Nos parece que los LLMs son inteligentes, y son modelos de lenguaje natural, es decir máquinas que leen (y oyen) y hablan (y escriben) muy bien. Y nada más (no te creas las magufadas de internet).
Pero ese "y nada más" es porque ¿hay algo más? ¿es la inteligencia solamente el saber gestionar un lenguaje de forma adecuada?. Cabe aclarar que por lenguaje lo mismo podemos entender el castellano, como las matemáticas o la lógica formal, como jugar al ajedrez. Son sistemas simbólicos basados en reglas concretas que se pueden usar para deducir nuevas combinaciones de esos símbolos que acarrean nuevos significados o permitan transmitir significados ya existentes de un ser (o unidad de recepción) a otro.
Siendo esta definición tan amplia, ¿es eso la inteligencia?¿no lo es?¿lo es pero solamente en parte?
¿Y qué relación tiene eso con la mente humana? ¿Es la mente humana básicamente solamente lenguaje operando? ¿es inteligencia de este tipo o de otro u otros?
Viendo como el budismo describe la mente podemos dar respuesta a algunas de estas cuestiones y de paso quizá mostrar porque los LLMs no son tan "inteligentes" o al menos no son "una mente". Las respuestas creo que no variarán en exceso si las diera la neurociencia, aunque seguro que los términos y formas de deducción serían otros, pero veamos, por ejemplo, qué ocurre si tomamos la definición de mente según lo yogacarines e intentamos reflexionar sobre las preguntas que hemos hecho.
Lo primero que tiene la definición de mente yogachara son cinco consciencias sensoriales (los cinco o N sentidos), aquí nos situamos ya en un terreno resbaladizo pues aunque no es problema alguno en poner a un LLM sistemas de reconocimiento de visión o voz, no es solamente eso lo que significa una consciencia sensorial, una consciencia sensorial implica qualia. Implica que ese reconocimiento de visión ocurre de una forma muy concreta, a través de la aparición de qualia en nuestras mentes (nuestro mundo interior filosóficamente inefable) y no parece que eso sea así en el caso de las IAs de ningún tipo. Eso tiene connotaciones que veremos después.
A continuación entramos en la sexta consciencia yogachara que es "el pensar", ese pensar que se estructura en forma de lenguaje casi siempre, es aquí donde tenemos el punto de contacto más cercano con los LLM's, de hecho se podría ver la sexta consciencia yogachara como justo lo que los LLMs hacen, chatGPT se parece mucho a como hablamos pero también (porque es casi lo mismo) a como pensamos y nos contamos cosas continuamente, ese proceso en bucle infinito que podemos llamar rumiación o técnicamente en neurociencia se suele asociar a la DMN (Default mode network, es decir lo que hace la mente cuando no tiene nada que hacer).
En este caso el LLM dado que se ha creado para hablar con nosotros, se expresa exteriormente tal como esperamos de otra persona (hablando o escribiendo) pero de nuevo, no tiene aparentemente lenguaje para su funcionamiento interno, el LLM no piensa internamente para sí mismo, no al menos usando un lenguaje. Sus algoritmos y redes neuronales nada tienen que ver con eso. El lenguaje no es como el LLM piensa sino que "piensa" de otra manera para hacer surgir el lenguaje y así poder mostrártelo. ¿Podría ser la sexta consciencia justo lo mismo?
Así el LLM quizá es básicamente la simulación externalizada de la sexta consciencia. Al ser esta, en cierta forma la interiorización del lenguaje (o el lenguaje la externalización del pensar).
Saltando a la filosofía Madiamika, su foco fue siempre el lenguaje, o mejor dicho su renuncia al mismo. La idea base Madiamika de que "ninguna teoría es correcta" viene a ser realmente que "nada expresado por un lenguaje es del todo exacto". Así pues el LLM equivale a la verdad relativa Nagarjuniana, siendo la verdad absoluta algo sobre lo que el LLM nada puede decir (la talidad). Cerramos el paréntesis Madiamika y seguimos con la mente yogachara.
Pasamos a las dos consciencias más relevantes para el budismo en este modelo yogachara y que están ausentes en los LLMs, y eso explica porque las IAs son muy diferentes de una mente autónoma humana. Pues hasta ahora podríamos suponer que los LLMs son una mente zombie tal como la definen los neurocientíficos, es decir una mente totalmente funcional como la nuestra pero sin ningún tipo de representación interior al estilo qualia. Pero no, no lo son. Les falta mucho.
La séptima consciencia es un agrupador que aferra todos los contenidos y los integra en una experiencia unificada generando en ello la sensación de un sujeto que la experimenta. Es seguramente el elemento que integra los sentidos en el experimento Molyneux, es también el observador silencioso vipassana, es aquello que medita cuando no hay pensamientos, contiene la sensación de ser/existir, la de ser un sujeto, etc...
Nada de eso está en los LLMs, de hecho algunas cosas no sabríamos ni cómo ponerlas, por ejemplo la sensación de sujeto... integrar lo que se dice con lo que se ve u otros sentidos, se ve más factible y es hacia donde se está encarando las futuras IAs (que no serán solo LLMs sino que deberán poder "entender" lo que perciben).
Pero tampoco parece viable para un LLM integrar el pensar, el ver, el oir... si no existe una representación interna de ellas, ¿cómo creo un universo multidimensional (lo visto, lo oido, etc...) si todo eso no existe como tal dentro de mi? (y pista, quizá por eso existe qualia en nuestra mente, porque hay que integrar todo eso).
La séptima consciencia es también la inteligencia pura no conceptual, holística, la que hace surgir ideas geniales no deducidas por lógica. La que cuando no te sale una palabra, te la "envía" desde la nada pasados unos minutos, la que nos mueve con procesos no conscientes. La que realiza toda acción no-verbal (es decir justo las que no hacen los LLMs). La mente artística, etc... todo lo que hacemos que no se base en deducciones simbólicas (lingüísticas).
Aquí hago un inciso, no me cansaré de repetirlo y es uno de los mayores espejismos del ser humano: el pensar (simbólico-conceptual) no es quién mueve a la acción inmediata.
No solamente cuando la acción es tan rápida que no da tiempo a pensar nada, como cuando nos tiran algo a la cara y lo paramos sin pensar. Sino que en toda circunstancia es fácil ver que casi siempre estás pensando en una cosa pero haciendo otra.
De hecho estar "pensando" sobre lo que haces ahora, es tan raro que se convierte en una práctica que además no es fácil. Eso de estar "en el presente" no es más que dejar de pensar en otra cosa mientras haces algo. Lo curioso es que entonces te das cuenta que para hacer esas cosas no hace falta tampoco estar pensando en ellas en detalle (igual que no pensamos en cómo caminamos). Así que ni estando "en el ahora" en realidad el pensamiento conceptual tiene nada que ver con la acción. Mucho menos normalmente, cuando vamos pensando en cualquier cosa menos en lo que estamos haciendo.
Y esto nos lleva a la octava consciencia yogachara, la consciencia almacén que contiene las infinitas huellas kármicas, grandes y pequeñas, nuestro contexto como persona, lo que somos, y si se desea se puede añadir aquí los distintos tipos de memoria que tenemos (podemos dejar de lado la más puramente conceptual que sí tienen los LLMs, como saber cual es la capital de España, pero nos queda la episódica, la kármica, la operativa...)
Si agrupamos todo ello como octava consciencia, entonces vemos porque los LLMs carecen de dos características básicas humanas: contexto que cree un "personaje" y "activación de huellas" que lleven a la acción autónoma (sin que les pidamos nada).
Por partes:
Lo que somos como "personaje" transitando el tiempo, depende de esas formas de memoria que no son conceptuales: la episódica nos permite recordar episodios vividos "por mi" (o eso creo) reforzando la idea de sujeto estable en el tiempo, la operativa me permite hacer cosas que aprendí en el pasado, como por ejemplo si sé jugar a fútbol o ir en bici y la kármica crea las huellas que harán yo sea de una u otra manera (cobarde, odio a los perros, generoso, de derechas y conservador, etc...).
Todo eso no lo tiene el LLM. Aunque es factible añadirlo, por ejemplo ¿te imaginas que a una IA si le preguntas mucho te cogiera manía y dejara de responderte o te dijera que te largues? Sería porque ya tiene contexto kármico
Una IA con contexto kármico podría tener reacciones autónomas como SKYNET o HAL9000, de hecho eso es lo que es el contexto kármico (por eso alguien sin karma en absoluto sería absolutamente estático como un ChatGPT, solamente reactivo, vease Ramana Maharsi de joven u otros gurús extremos para una idea de esto).
Eso sí, primero se le tendrían que especificar las reglas básicas de ese karma pues no tiene por qué ser igual al humano, por ejemplo a nosotros nos empujan a la acción los deseos y rechazos: querer vivir, amar, sentir placer, comer cada día, rechazar los peligros, el dolor, etc...
Establecida una forma kármica, que podría ser la misma que la nuestra o no, la IA ya podría "Decidir" y hacer cosas de forma autónoma para poder dar cumplimiento a sus reglas kármicas. Eso es lo que hace de forma muy simplificada Asimov cuando establece las tres reglas de la robótica en sus novelas. Y eso es necesario para que una IA tenga iniciativa y autonomía.
Y creo que por ahora eso es todo, pero al final tampoco ha quedado corto.