facebook pixel
Anthropic acaba de publicar un paper que le mete presión al debate sobre si la IA tiene algún tipo de conciencia interna. Se llama "Emergent Introspective Awareness in Large Language Models", de Jack Lindsey (Anthropic, octubre 2025). El experimento: en vez de escribir un prompt, inyectaron directamente en las capas internas de Claude la representación matemática de un concepto, sin pasar por texto. Antes de que el modelo generara nada, algunos identificaron que había algo extraño en su propio procesamiento. Antes, si forzabas a un modelo a "pensar" en algo, lo repetía sin parar como un títere sin saber por qué. Acá, Claude Opus 4 y 4.1 separaron su propio razonamiento de la intrusión artificial en ciertos casos. El matiz importante: los propios autores dicen que esta capacidad es "altamente poco fiable y depende del contexto". No es una alarma que se activa siempre. Y otros investigadores de la comunidad de seguridad de IA advirtieron que llamarlo "conciencia" es un salto que el ex...

 111

 1

    Suggested Credits
    Tags, Events, and Projects