O Google lançou hoje o Gemini 4 Argon, seu novo modelo de ponta. E ele chegou liderando 13 dos 19 testes da tabela oficial da empresa. 🚀
O que você precisa saber:
🧠 O que é: um modelo feito para raciocinar fundo por muito tempo, em trabalhos longos e com muitas etapas. Os focos são programação, trabalho corporativo como jurídico e finanças, e defesa cibernética.
📏 1 milhão de tokens de saída: o limite do que ele pode pensar e escrever numa única resposta subiu de 64 mil para 1 milhão. Quase 16 vezes mais.
🏆 Onde lidera: Vals Index (68,9%), DeepSWE v1.1 (77,9%), contexto longo de 256 mil a 1 milhão de tokens (84,2% contra 71,8% do GPT-6 Astra) e jurídico no Harvey's Legal Agent Benchmark (19,6% contra 6,7% do melhor rival).
⚠️ Onde perde: Terminal-bench 4.0 (Claude Opus 5.5 com 66,4%), FrontierSWE v2 e OSWorld-2.0 (GPT-6 Astra na frente). Na correção de falhas de segurança, empata com o GPT-6 Astra.
🔒 Quem pode usar: por enquanto, só defensores de cibersegurança do programa F...
Suggested Credits
Tags, Events, and Projects