A Anthropic anunciou o Claude Mythos, seu modelo mais poderoso.
Ele encontra e explora vulnerabilidades de software de forma autônoma, incluindo um bug de 27 anos no OpenBSD e uma falha de 16 anos no FFmpeg que passou por 5 milhões de testes sem ser detectada.
A empresa decidiu não lançar o modelo ao público e criou o Project Glasswing, consórcio com Apple, Google, Microsoft, NVIDIA e mais 40 organizações para usar o Mythos apenas na defesa de infraestrutura crítica. A Anthropic comprometeu até US$ 100 milhões em créditos para o programa.
No benchmark CyberGym, o Mythos acertou 83% dos testes, contra 67% do segundo melhor modelo testado.
Comente “NEWS” para receber a newsletter semanal de IA.
—
Fonte: Anthropic, TechCrunch
#inteligenciaartificial #anthropic #ciberseguranca