A Google apresentou o Gemini 4 Argon, o primeiro modelo da nova série Gemini 4, dando início a uma nova etapa na inteligência artificial da empresa. O sistema foi concebido para responder a exigências de alto nível em áreas como programação, defesa em cibersegurança e trabalho corporativo especializado nos setores jurídico e financeiro.
Esta novidade surge numa altura em que a gigante tecnológica procura reforçar a sua posição no desenvolvimento de modelos de ponta para tarefas críticas. Embora a empresa tenha lançado várias atualizações para a gama Flash, vinha a perder terreno para os modelos concorrentes da OpenAI e da Anthropic em domínios como a engenharia de software e a segurança informática. O lançamento sucede também ao cancelamento interno do Gemini 3.5 Pro, modelo cuja chegada esteve prevista para junho, mas que acabou por ser adiado sucessivamente e não chegou a ser lançado devido ao fraco desempenho.
Testes de segurança e desempenho em ambiente real
Numa fase inicial, o Gemini 4 Argon fica disponível exclusivamente para um conjunto de parceiros selecionados através do programa Fairwind. Esta iniciativa permite a governos e autoridades de cibersegurança previamente validados testar proativamente o novo modelo e corrigir vulnerabilidades de sistemas.
Nos testes de avaliação, a Google indica que o Argon empatou com o GPT-6 Astra da OpenAI no topo da pontuação do teste CWE-bench, focado na identificação e correção de falhas de segurança. Além disso, a empresa garante que o modelo estabeleceu um novo recorde nos testes de tarefas de engenharia complexas e de longa duração inspiradas no mundo real.

Apesar destes resultados, ainda não existe uma data para a disponibilização ao público em geral. A tecnológica esclareceu que está a colaborar ativamente com a estrutura de acesso antecipado do governo dos Estados Unidos para avaliar os riscos de cibersegurança antes do lançamento comercial.
Utilização interna e mecanismos de controlo
Dentro da própria Google, as equipas de engenharia já estão a utilizar o novo modelo em tarefas de depuração de código e em migrações de grande escala de bases de código. Segundo os dados divulgados pela empresa, o Argon permitiu libertar mais de 300 tebibytes de memória nos seus centros de dados sem necessidade de adicionar novo hardware.
Para mitigar os riscos de o modelo agir de forma indesejada ou desalinhada com os objetivos definidos, foram implementados sistemas capazes de rastrear a cadeia de raciocínio do Argon e interromper a sua execução sempre que necessário. As salvaguardas incluem também cuidados específicos na forma como o modelo recebe feedback, evitando ensinar o sistema a contornar os mecanismos de monitorização.
(TT)
