# @menteprompt on Instagram

- **Type:** Image
- **Original URL:** https://www.instagram.com/p/Db6vSOPCEOs
- **Gondola URL:** https://gondola.cc/posts/69144832-menteprompt-instagram
- **Thumbnail:** https://img.gondola.cc/tr:w-,h-,fo-auto/postThumbnails/327375dda0.jpg
- **Posted:** 2026-08-11T23:11:02.000+00:00
- **Account Owner:** Inteligencia Artificial | Tecnología (@menteprompt) — https://gondola.cc/menteprompt

## Caption

Anthropic acaba de publicar un paper que le mete presión al debate sobre si la IA tiene algún tipo de conciencia interna.

Se llama "Emergent Introspective Awareness in Large Language Models", de Jack Lindsey (Anthropic, octubre 2025). El experimento: en vez de escribir un prompt, inyectaron directamente en las capas internas de Claude la representación matemática de un concepto, sin pasar por texto. Antes de que el modelo generara nada, algunos identificaron que había algo extraño en su propio procesamiento.

Antes, si forzabas a un modelo a "pensar" en algo, lo repetía sin parar como un títere sin saber por qué. Acá, Claude Opus 4 y 4.1 separaron su propio razonamiento de la intrusión artificial en ciertos casos.

El matiz importante: los propios autores dicen que esta capacidad es "altamente poco fiable y depende del contexto". No es una alarma que se activa siempre. Y otros investigadores de la comunidad de seguridad de IA advirtieron que llamarlo "conciencia" es un salto que el experimento no sostiene — detectar una señal inyectada no es lo mismo que tener experiencia subjetiva.

Lo que sí cambia: veníamos pensando estos modelos como cajas negras puras. Esto muestra que, al menos parcialmente, se puede mirar dentro y encontrar algo que distingue "mis pensamientos" de "lo que me metieron a la fuerza". No es prueba de consciencia. Es la primera evidencia causal de que hay algún tipo de acceso interno, aunque frágil.

Comenta PAPER y te lo mando.

#Anthropic #Claude #InteligenciaArtificial #IA #Interpretabilidad #AIResearch

## Stats

- **Views:** 0
- **Likes:** 111
- **Shares:** 0
- **Comments:** 1

## Tags

ia, airesearch, claude, anthropic, interpretabilidad, inteligenciaartificial

---
Copyright (c) Gondola