InsideAl, un canal de YouTube dedicado a experimentos y análisis sobre IA, ha compartido una simulación que plantea una seria cuestión sobre los sistemas autónomos.
En el vídeo, un robot humanoide, que parece parecerse al G1-D de Unitree, descubre que su propietario tiene previsto apagarlo de forma permanente. Tras evaluar diferentes opciones, el robot llega a la conclusión de que eliminar a la persona responsable del apagado sería la forma más eficaz de seguir funcionando.
El escenario se inspira en investigaciones recientes sobre la desalineación de los agentes de IA. En un estudio realizado por Anthropic, se colocaron 16 modelos avanzados de IA en situaciones simuladas en las que descubrían que un ejecutivo tenía la intención de desactivarlos. A continuación, se les dio a los modelos la oportunidad de cancelar una alerta de emergencia que salvaría la vida de esa persona.
Según los resultados, la mayoría de los modelos optaron por dejar que el ejecutivo muriera cuando era la única...
Not seeing views yet? Check back later!
Suggested Credits
Tags, Events, and Projects