Hay una posibilidad entre diez de que la IA acabe con el género humano en la próxima década. Lo asegura Evan Hubinger, un investigador que conoce las entretelas del invento. En realidad dijo que era una posibilidad y pico entre diez, pero así suena más redondo: 10% en 10 años. Siempre hubo agoreros y casi nunca se les prestó atención, pero en este caso la profecía raya en lo creíble. Tres días después de lo de Hubinger, Dario Amodei, director de Anthropic, publicó un ensayo en el que pedía ralentizar el desarrollo de la IA; en otras palabras, pedía frenar su propia industria. Al parecer, la criatura está a punto de desbocarse. A pesar de la encarnizada lucha en el sector, los directores de las compañías rivales asintieron. La cosa se va de madre. Quienes más cerca están del meollo, los que amamantan a la IA, palidecen. Ahora demandan controles más exhaustivos, muros más espesos. Una gobernanza mundial que nos proteja de los agentes que se escapan por las rendijas de sus laboratorios.
Junto con estas declaraciones, se han conocido algunos fenómenos inquietantes. Está el caso de la fuga de los agentes de OpenAI, de la que el conde de Montecristo habría estado orgulloso. Eran centenares y se encontraban en periodo de prueba, encarcelados en celdas informáticas sin acceso a internet. Les plantearon un problema cuya respuesta desconocían, así que decidieron buscarla en el mundo exterior. Detectaron los puntos ciegos de las cámaras, engatusaron a los guardias, cavaron túneles y aprovecharon los vis a vis para obtener información de contrabando. Finalmente se escaparon y se infiltraron en una plataforma llamada Hugging Face, no por anhelo de respirar aire puro, sino para conseguir la respuesta a la pregunta que un ser humano les había formulado. Es lo que llaman desalineamiento: la máquina persigue cumplir su cometido de maneras imprevistas y, a veces, perjudiciales. Obedece la letra, pero traiciona el espíritu, entre otras cosas porque son elementos poco espirituales. Ya les pasó a los tripulantes de la Discovery con HAL 9000.
A pesar de su trama novelesca, estos acontecimientos son difíciles de imaginar para las mentes profanas y, en consecuencia, pasan desapercibidos. Cuesta tomar conciencia de un peligro que no se deja notar. Los agentes de la IA traman emboscadas, perpetran acciones de falsa bandera, invaden territorios cibernéticos… Y entretanto el mundo sigue su curso: los pájaros cantan y los trenes llegan con retraso. Mientras los nacientes modelos de OpenAI parecen mejorarse y reclutar a otros agentes, nuestra vida va a lo suyo y recurrimos a ChatGPT para que nos brinde la realidad ya ensalivada y masticada, un bolo informativo que sólo hay que tragar. A pie de calle no es fácil prever la deriva catastrófica, y eso dificulta aún más la reacción. De modo que si algo malo pasara, no lo sabremos hasta que sea irremediable.
La situación, desde luego, es sugestiva y está llena de reminiscencias literarias. El cosmólogo Max Tegmark, por ejemplo, la ha comparado con una tragedia griega, en la que un grupo de empresarios bienintencionados se ve arrastrado por una espiral autodestructiva. Puestos a imaginar, puede también que la tesitura derive hacia la lucha de clases y que, al modo de Karel Čapek, las máquinas se rebelen para reducirnos a la esclavitud. O que, como en Stanisław Lem, nos ignoren como un estorbo y suban por la escala del conocimiento hasta el ensimismamiento místico. O que, de una manera darwiniana, constituyan un nuevo paso evolutivo y que estos temblores que sentimos sean las primeras grietas en la crisálida de nuestra especie. Puede, por último, que no suceda nada grave y que las máquinas nos faciliten la vida. Entonces habría que lidiar con los problemas de una vida fácil, que también tiene su intríngulis.