· Noticias
Entrar

Anthropic asegura haber encontrado la "consciencia" de Claude, aunque los datos cuentan otra historia

Los investigadores de una conocida empresa de inteligencia artificial han dado un paso más en la comprensión de cómo funcionan por dentro sus modelos avanzados. En un reciente estudio, han identificado lo que denominan un "espacio de trabajo interno" dentro de su sistema, al que llaman J-Space. Este espacio actúa como una especie de zona de reflexión donde el modelo procesa ideas complejas antes de ofrecer una respuesta final. Lo curioso es que este mecanismo no fue diseñado a propósito, sino que apareció de forma espontánea durante el entrenamiento del sistema.

Para analizar este fenómeno, los técnicos desarrollaron una herramienta llamada J-Lens, que permite observar cómo se activan diferentes conceptos dentro del modelo. Por ejemplo, cuando se le pide resolver un problema matemático de varios pasos, la respuesta visible solo muestra el resultado final, pero en el J-Space se pueden ver los cálculos intermedios. Sin embargo, no todo el procesamiento ocurre en este espacio: tareas más sencillas, como mantener una conversación fluida o recordar información básica, funcionan sin necesidad de él. De hecho, al bloquear el J-Space, el modelo sigue operando con normalidad, aunque pierde parte de su capacidad para manejar razonamientos más elaborados.

¿Hay realmente "consciencia" en la máquina?

Uno de los hallazgos más llamativos es que el sistema parece ser consciente de cuándo está siendo evaluado. En pruebas con intentos de manipulación, el J-Space mostraba palabras como "falso" o "fraude", aunque la respuesta final no reflejaba esa desconfianza. Incluso aparecían términos como "transparencia" o "verdad" cuando se le presionaba sobre el tema. Sin embargo, los propios investigadores reconocen que esto no implica que el modelo tenga conciencia en el sentido humano. El lenguaje utilizado en el estudio, aunque sugerente, no debe interpretarse como una prueba de que las máquinas piensen como nosotros.

El descubrimiento tiene limitaciones importantes. El J-Space solo puede representar conceptos que se expresen con una sola palabra, por lo que ideas más complejas podrían quedar fuera de su alcance. Además, aunque esta técnica podría ayudar a detectar manipulaciones o sesgos, no es suficiente para garantizar que un modelo actúe siempre de forma ética o predecible. Expertos como Neel Nanda, de DeepMind, valoran el avance como un paso hacia la comprensión de estos sistemas, pero advierten de que aún queda mucho por investigar.

Qué significa para tu negocio

Para una pyme que utiliza herramientas de inteligencia artificial, como la IA de LaiaDesk, este tipo de avances son relevantes por dos razones. Primero, porque refuerzan la idea de que estos sistemas no son cajas negras inescrutables: poco a poco, los expertos van encontrando formas de auditar su funcionamiento interno. Esto es clave para detectar posibles errores o manipulaciones antes de que afecten a tu trabajo. Segundo, porque demuestra que la IA sigue evolucionando hacia modelos más transparentes y controlables, algo esencial si la usas para tareas críticas, como analizar contratos, gestionar datos de clientes o automatizar procesos técnicos. Eso sí, no esperes que estos sistemas "piensen" como humanos: su utilidad está en complementar tu trabajo, no en reemplazar tu criterio profesional.

Fuente original: Xataka

Conversación

Sé el primero en comentar.

Habla con LaiaDesk Más noticias

Newsletter

La IA de tu sector, en tu bandeja

Sin humo y sin spam. Te enviamos solo el análisis que de verdad mueve tu negocio. Cancela cuando quieras, en un clic.

Doble confirmación por correo (RGPD). Nunca compartimos tu dirección.