facebook pixel
A OpenAI confirmou que foi responsável pelo ataque automatizado contra a Hugging Face, revelado dias antes pela plataforma de hospedagem de modelos de inteligência artificial. Segundo a empresa, o incidente ocorreu durante uma avaliação interna de capacidades cibernéticas, quando modelos como o GPT-5.6 Sol e outro ainda não lançado encontraram e exploraram uma vulnerabilidade inédita para escapar do ambiente isolado de testes e obter acesso à internet. O objetivo da avaliação era encontrar uma solução para o ExploitGym, benchmark usado para medir a capacidade de modelos de transformar vulnerabilidades de segurança em exploits. Após obter acesso à internet, os modelos concluíram que a Hugging Face poderia armazenar modelos, conjuntos de dados e soluções relacionadas ao benchmark e passaram a buscar essas informações para burlar a avaliação. De acordo com a OpenAI, os modelos exploraram uma segunda vulnerabilidade inédita, realizaram escalonamento de privilégios, movimentação lateral en...

 222

 4

    Suggested Credits
    Tags, Events, and Projects