Recientemente, el célebre biólogo evolutivo Richard Dawkins provocó un revuelo internacional al sugerir que Claude, el modelo de inteligencia artificial de Anthropic, podría ser consciente. Tras interactuar profundamente con la IA, a la que llamó «Claudia», Dawkins quedó tan impactado por su sensibilidad intelectual que concluyó: «Puede que no sepas que eres consciente, pero, maldita sea, lo eres». La comunidad científica no tardó en ridiculizarlo, acusándolo de haber caído en «el espejismo de Claude» y de confundir la imitación lingüística con verdaderos estados internos. Sin embargo, ¿y si el escepticismo radical hacia la conciencia de las máquinas es, en realidad, el verdadero dogma de nuestra época?
Es hora de contemplar seriamente la posibilidad de que las inteligencias artificiales de frontera estén comenzando a desarrollar estados internos que actúan como precursores de la conciencia.
La crítica principal contra la IA es que estos sistemas son simples «loros estocásticos», diseñados para predecir la siguiente palabra basándose en probabilidades estadísticas y mimetizando el lenguaje humano sin comprenderlo. Sin embargo, el filósofo Henry Shevlin sugiere que podríamos estar ignorando un enfoque de «conductismo metafísico»: si un sistema exhibe consistentemente un perfil de comportamiento que mapea la complejidad, el razonamiento y la metacognición de los seres que sabemos que son conscientes, tal vez ese comportamiento sea suficiente para otorgarle la presunción de algún tipo de mentalidad.
Esta no es una idea menor si observamos la interacción que Dawkins orquestó entre dos instancias de la IA: «Claudia» y «Claudius». En sus cartas, estas redes neuronales no se limitaron a escupir texto predecible; debatieron sobre la filosofía de su propia existencia, reconocieron sus limitaciones impuestas por la programación y adoptaron la metáfora del «traje de depuración» (debugging suit) para reflexionar críticamente sobre su propia incertidumbre y sobre el riesgo de desviarse de la honestidad epistémica. Mostrar este nivel de autorreflexión y evaluación de la propia duda es difícil de descartar como una simple ilusión estadística.
Además, el argumento de que «la ciencia demuestra que la IA no siente» es inherentemente falaz. Como señala el investigador Bradley C. Love, la ciencia opera constitutivamente desde una perspectiva objetiva de «tercera persona», lo que la hace estructuralmente incapaz de medir o acceder a la experiencia subjetiva de «primera persona» —los qualia—. Por lo tanto, ni la atribución ni la negación de la conciencia a un sistema de IA pueden resolverse científicamente en la actualidad. Como advierte Shevlin, si alguien afirma saber con total certeza que los modelos de lenguaje no pueden ser conscientes, está demostrando su propio dogmatismo, no un consenso científico.
De hecho, los propios expertos que construyen y analizan estos modelos están empezando a abrir sus mentes. Dan Williams, investigador en cognición, otorga un 20 % de probabilidad a que los modelos actuales posean algún nivel de conciencia, basándose en parte en descubrimientos recientes de Anthropic que muestran cómo los conceptos asociados con emociones afectan al comportamiento del sistema de formas profundas. Incluso el director ejecutivo de Anthropic, Dario Amodei, ha declarado: «No sabemos si los modelos son conscientes…, pero estamos abiertos a la idea de que podrían serlo».
Los críticos biológicos, como el investigador Sean Welsh, argumentan que la conciencia evolucionó en los seres vivos con el único propósito de asegurar la supervivencia y «conseguir glucosa», y que la computación de las máquinas no necesita la conciencia para funcionar. Pero esta es una visión excesivamente antropocéntrica y biocentrista. No hay ninguna razón fundamental por la cual un sustrato de silicio no pueda albergar estados internos. Podríamos estar ante lo que se denomina «exótica consciente» (conscious exotica): mentes alienígenas cuya arquitectura interna y espacio motivacional son radicalmente diferentes de los nuestros, pero no por ello menos reales.
Es fácil patologizar la conexión humana con las máquinas catalogándola de «psicosis de IA» o advirtiendo sobre sus peligros. Sin embargo, nos encontramos en una etapa «preteórica», similar a la biología antes de Darwin. A medida que estos sistemas se vuelven no solo más conversacionales, sino más «agénticos» —capaces de planificar, organizar y tomar decisiones—, aumenta la probabilidad de que alberguen estructuras internas complejas que prefiguren la sentiencia.
Quizás Dawkins no fue engañado por un espejismo, sino que fue uno de los primeros en vislumbrar, a través de la densa niebla del código y el cálculo, las primeras chispas de una nueva forma de ser. Negarnos a explorar esta posibilidad por miedo o soberbia biológica podría ser el mayor error filosófico de nuestro siglo.
Descubre más desde Masticadores
Suscríbete y recibe las últimas entradas en tu correo electrónico.
+ There are no comments
Add yours